3 समाचार संस्थान·4 रिपोर्टें·अवधि 23h
नया एआई ऑप्टिमाइज़ेशन फ्रेमवर्क समान कंप्यूट बजट पर Claude Code और Codex से 2.5 गुना बेहतर प्रदर्शन करता है
हालिया विश्लेषणों में इस बात पर प्रकाश डाला गया है कि पारंपरिक एआई बेंचमार्क अक्सर वास्तविक दुनिया के प्रदर्शन को दर्शाने में विफल रहते हैं और लेटेंसी व संसाधन उपयोग जैसी व्यावहारिक बाधाओं को नजरअंदाज कर देते हैं। इसके जवाब में, एक नए पेश किए गए ऑप्टिमाइज़ेशन फ्रेमवर्क ने समान कंप्यूट बजट के भीतर काम करते हुए Claude Code और Codex जैसे अग्रणी मॉडलों की तुलना में 2.5 गुना अधिक दक्षता प्रदर्शित की है। यह विकास बेंचमार्क परिणामों और वास्तविक तैनाती की प्रभावशीलता के बीच बढ़ते अंतर को लेकर चिंताओं को रेखांकित करता है।
यह सारांश नीचे दी गई सभी रिपोर्टों से बना है, किसी एक से नहीं।
यह पृष्ठ स्वतः अनूदित है। मूल रिपोर्टें अपनी मूल भाषा में हैं।
किसने क्या बताया
- VentureBeat·What AI benchmarks miss about real-world performance
- VentureBeat·New AI optimization framework beats Claude Code and Codex by 2.5x on the same compute budget
- MIT Tech Review·The Download: AI bottleneck debates, and BCI trials take off
- The Next Web·The bet against bigger models: Aether AI lands $20mn for causal AI