OpenAI revisó SWE-Bench Pro, una prueba ampliamente utilizada para medir las habilidades de programación de los modelos de IA, y descubrió que aproximadamente el 30 por ciento de sus tareas no funcionan. La compañía está retirando su respaldo anterior al índice de referencia. El…
Los nuevos modelos restablecen la frontera entre capacidad y precio-rendimiento. Los equipos reevalúan sobre qué construir cada vez que un lanzamiento cambia lo que es posible por dólar.
Empresas y modelos mencionados en esta historia: abra sus páginas y vea los precios en vivo
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.