Prime Intellect ha lanzado prime-rl 0.6.0, un framework abierto para aprendizaje reforzado asincrónico en modelos Mixture-of-Experts de un billón de parámetros. Entrenó GLM-5 en tareas SWE con una longitud de secuencia de hasta 131k, con s…
Los nuevos modelos restablecen la frontera entre capacidad y precio-rendimiento. Los equipos reevalúan sobre qué construir cada vez que un lanzamiento cambia lo que es posible por dólar.
Empresas y modelos mencionados en esta historia: abra sus páginas y vea los precios en vivo
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.