Ricevi un'e-mail quando il prezzo combinato di questo modello scende. Nessun account necessario.
Una e-mail per goccia. Annulla l'iscrizione in qualsiasi momento.
Prezzo combinato giornaliero ($/1 milione): registrato ogni giorno, si sviluppa in una tendenza nel tempo.
Tipico mix output-input 3:1, per 1 milione di token
Prezzo a partire da 2026-05-11 · Fonte: nvidia_reference_catalog
Carichi di lavoro generici per la generazione di testi, chat, riepiloghi e contenuti in cui contano di più l'ampia capacità e il basso costo.
Llama-3.3-Nemotron-Super-49B-v1.5 è un modello di ragionamento/chat incentrato sull'inglese con parametri 49B derivato da Llama-3.3-70B-Instruct di Meta con un contesto di 128K. È post-addestrato per i flussi di lavoro degli agenti (RAG, chiamate agli strumenti) vi...
llama-3.3-nemotron-super-49b-v1.5 è un modello Testo di NVIDIA (US). HotON.ai lo tiene traccia di $0.10 per 1 milione di token di input e $0.40 per 1 milione di token di output, con una finestra di contesto del token 131K. Il suo punteggio di efficienza composito è 89/100 con un $0.000 stimato per attività riuscita.
llama-3.3-nemotron-super-49b-v1.5 viene tracciato su $0.10 per 1 milione di token di input e $0.40 per 1 milione di token di output. Un tipico carico di lavoro output-to-input 3:1 si riduce a circa $0.33 per 1 milione di token. Le cifre sono dati dimostrativi illustrativi.
Carichi di lavoro generici per la generazione di testi, chat, riepiloghi e contenuti in cui contano di più l'ampia capacità e il basso costo.
llama-3.3-nemotron-super-49b-v1.5 supporta fino a una finestra di contesto del token 131K, abbastanza grande per documenti lunghi e conversazioni estese in un'unica richiesta.
All'interno dell'insieme tracciato HotON.ai, llama-3.3-nemotron-super-49b-v1.5 è più economico della 79% dei modelli sul prezzo di input e si classifica #154 di 535 in base all'efficienza complessiva.
Sì: deepseek/deepseek-v4-flash è un'opzione a costo inferiore a $0.28 per 1 milione di token di output, pur coprendo casi d'uso Testo simili. Confrontali fianco a fianco su HotON.ai.
Pronto per essere incollato in articoli, documenti o richieste di intelligenza artificiale: i prezzi e la data si aggiornano con i dati in tempo reale.
HotON.ai — llama-3.3-nemotron-super-49b-v1.5 (NVIDIA): $0.10/1M input, $0.40/1M output, as of 2026-05-11. https://hoton.ai/it/models/nvidia-llama-3-3-nemotron-super-49b-v1-5Il prezzo è reale (tramite il catalogo TestKey, aggiornato quotidianamente). La qualità (Arena Elo) è reale quando il modello è classificato su LMArena. L’efficienza è un modello composito di prezzo reale e contesto.