NVIDIA ha lanzado Nemotron 3 Ultra, un Mamba-Transformer híbrido abierto de mezcla de expertos con un total de 550 B (55 B activos) para agentes de larga duración. Combina un contexto de 1 millón de tokens con un rendimiento de inferencia hasta ~6 veces mayor que el de la comparación...
El suministro de computación, la energía y la capacidad de los centros de datos deciden qué tan barato puede funcionar la IA. Los cambios en la infraestructura aparecen en los costos de inferencia semanas después.
Empresas y modelos mencionados en esta historia: abra sus páginas y vea los precios en vivo
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.