OpenAI contrasta il record ARC-AGI-3 di Anthropic: GPT-5.6 Sol ottiene un punteggio del 38,3%, ma solo con le proprie funzionalità API invece della configurazione di test ufficiale, dove il modello è arrivato al 7,8%. ARC Prize rivendica il suo ambiente di prova...
I nuovi modelli ripristinano la frontiera della capacità e del rapporto prezzo-prestazioni. I team rivalutano su cosa costruire ogni volta che un lancio cambia ciò che è possibile fare per ogni dollaro.
Aziende e modelli menzionati in questa storia: apri le loro pagine e scopri i prezzi
I riepiloghi sono aggregati solo a scopo informativo: segui il collegamento alla fonte per la storia completa. Le voci demo sono illustrative.