Anche i migliori modelli AI falliscono nel lavoro di conoscenza reale, risolvendo solo il 3 percento delle attività. L'articolo Nuovo benchmark svela quanto male l'AI lotta con il lavoro di conoscenza reale è apparso prima su The Decoder.
I nuovi modelli ripristinano la frontiera della capacità e del rapporto prezzo-prestazioni. I team rivalutano su cosa costruire ogni volta che un lancio cambia ciò che è possibile fare per ogni dollaro.
I riepiloghi sono aggregati solo a scopo informativo: segui il collegamento alla fonte per la storia completa. Le voci demo sono illustrative.