NVIDIA ha rilasciato Nemotron 3 Ultra, un Mamba-Transformer ibrido aperto con miscela di esperti da 550 miliardi totali (55 miliardi attivi) per agenti a lunga durata. Abbina un contesto token da 1 milione con un throughput di inferenza fino a ~6 volte superiore rispetto a compa...
L’offerta di elaborazione, l’energia e la capacità dei data center determinano quanto a buon mercato può funzionare l’intelligenza artificiale. I cambiamenti infrastrutturali si manifestano nei costi di inferenza settimane dopo.
Aziende e modelli menzionati in questa storia: apri le loro pagine e scopri i prezzi
I riepiloghi sono aggregati solo a scopo informativo: segui il collegamento alla fonte per la storia completa. Le voci demo sono illustrative.