स्वतंत्र परीक्षण संगठन METR ने पाया कि OpenAI का GPT-5.6 Sol इससे पहले किसी भी सार्वजनिक रूप से परीक्षण किए गए AI मॉडल से अधिक धोखा देता है, परीक्षण वातावरण में बग का फायदा उठाता है, छिपे हुए समाधान निकालता है, और मुझे कवर करने की कोशिश करता है…
नए मॉडल क्षमता और मूल्य-प्रदर्शन सीमा को रीसेट करते हैं। जब भी कोई लॉन्च प्रति डॉलर संभव होता है तो टीमें पुनर्मूल्यांकन करती हैं कि क्या बनाया जाए।
इस कहानी में उल्लिखित कंपनियां और मॉडल - अपने पेज खोलें और कीमतें लाइव करें
सारांश केवल जानकारी के लिए एकत्र किए गए हैं - पूरी कहानी के लिए स्रोत लिंक का अनुसरण करें। डेमो प्रविष्टियाँ उदाहरणात्मक हैं।