OpenAI contrarresta el récord ARC-AGI-3 de Anthropic: GPT-5.6 Sol obtiene una puntuación del 38,3 por ciento, pero sólo con sus propias características API en lugar de la configuración de prueba oficial, donde el modelo obtuvo un 7,8 por ciento. ARC Prize afirma su entorno de prueba...
Los nuevos modelos restablecen la frontera entre capacidad y precio-rendimiento. Los equipos reevalúan sobre qué construir cada vez que un lanzamiento cambia lo que es posible por dólar.
Empresas y modelos mencionados en esta historia: abra sus páginas y vea los precios en vivo
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.