सबसे अच्छी एआई मॉडल भी वास्तविक ज्ञान कार्य में विफल होती है, केवल 3 प्रतिशत कार्यों को पूरी तरह से हल करती है। लेख नया बेंचमार्क खुलासा करता है कि कैसे एआई वास्तविक ज्ञान कार्य के साथ संघर्ष करता है द डिकोडर पर पहले प्रकाशित हुआ।
नए मॉडल क्षमता और मूल्य-प्रदर्शन सीमा को रीसेट करते हैं। जब भी कोई लॉन्च प्रति डॉलर संभव होता है तो टीमें पुनर्मूल्यांकन करती हैं कि क्या बनाया जाए।
सारांश केवल जानकारी के लिए एकत्र किए गए हैं - पूरी कहानी के लिए स्रोत लिंक का अनुसरण करें। डेमो प्रविष्टियाँ उदाहरणात्मक हैं।