AMD lanzó Instella-MoE-16B-A3B, un modelo de lenguaje de mezcla de expertos completamente abierto entrenado desde cero en las GPU Instinct MI300X y MI325X. Tiene un total de 16 mil millones de parámetros pero activa solo 2,8 mil millones por token, utilizando Gated MLA...
Los precios de los tokens fijan el suelo en los márgenes de cada producto de IA. Cuando un proveedor cambia los precios, esto repercute en los competidores, las opciones de ruta y el costo de cada característica posterior.
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.