OpenAI contraria o recorde ARC-AGI-3 da Anthropic: GPT-5.6 Sol pontua 38,3 por cento, mas apenas com seus próprios recursos de API em vez da configuração de teste oficial, onde o modelo atingiu 7,8 por cento. Prêmio ARC reivindica seu ambiente de teste…
Novos modelos redefinem a fronteira de capacidade e preço-desempenho. As equipes reavaliam o que desenvolver sempre que um lançamento muda o que é possível por dólar.
Empresas e modelos mencionados nesta história – abra suas páginas e preços ao vivo
Os resumos são agregados apenas para fins informativos – siga o link da fonte para ver a história completa. As entradas de demonstração são ilustrativas.