A NVIDIA lançou o Nemotron 3 Ultra, um Mamba-Transformer híbrido aberto de mistura de especialistas com capacidade total de 550B (55B ativos) para agentes de longa duração. Ele emparelha um contexto de token de 1 milhão com uma taxa de transferência de inferência até ~ 6x maior do que a compa…
O fornecimento de computação, a energia e a capacidade do data center decidem o quão barato a IA pode funcionar. As mudanças na infraestrutura aparecem nos custos de inferência semanas depois.
Empresas e modelos mencionados nesta história – abra suas páginas e preços ao vivo
Os resumos são agregados apenas para fins informativos – siga o link da fonte para ver a história completa. As entradas de demonstração são ilustrativas.