DFlash de la Universidad de California en San Diego reemplaza la elaboración autoregressive con un modelo de difusión de bloques ligeros para la decodificación especulativa. Elabora bloques de tokens completos en un solo paso hacia adelante y condiciona sobre características ocultas objetivo…
El suministro de computación, la energía y la capacidad de los centros de datos deciden qué tan barato puede funcionar la IA. Los cambios en la infraestructura aparecen en los costos de inferencia semanas después.
Empresas y modelos mencionados en esta historia: abra sus páginas y vea los precios en vivo
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.