Erhalten Sie eine E-Mail, wenn der Mischpreis dieses Modells sinkt. Kein Konto erforderlich.
Eine E-Mail pro Drop. Abmelden jederzeit möglich.
Täglicher gemischter Preis ($/1 Mio.) – wird jeden Tag aufgezeichnet und bildet im Laufe der Zeit einen Trend.
Typischer 3:1-Output-to-Input-Mix pro 1 Mio. Token
Preis ab 2026-05-11 · Quelle: nvidia_reference_catalog
Universelle Textgenerierung, Chat, Zusammenfassung und Content-Workloads, bei denen umfassende Funktionalität und niedrige Kosten am wichtigsten sind.
Llama-3.1-Nemotron-Ultra-253B-v1 ist ein großes Sprachmodell (LLM), das für fortgeschrittene Reasoning, menscheninteraktive Chats, Retrieval-augmented Generation (RAG) und Tool-Calling-Aufgaben optimiert ist. Es leitet sich aus Meta's Llama-3.1-40...
llama-3.1-nemotron-ultra-253b-v1 ist ein Text-Modell von NVIDIA (US). HotON.ai verfolgt es bei $0.60 pro 1 Mio. Eingabe-Tokens und $1.80 pro 1 Mio. Ausgabe-Tokens mit einem 131K-Token-Kontextfenster. Sein zusammengesetzter Effizienzwert beträgt 89/100 bei einem geschätzten $0.002 pro erfolgreicher Aufgabe.
llama-3.1-nemotron-ultra-253b-v1 wird bei $0.60 pro 1 Mio. Eingabe-Tokens und $1.80 pro 1 Mio. Ausgabe-Tokens verfolgt. Eine typische 3:1-Ausgabe-zu-Eingabe-Arbeitslast ergibt ungefähr $1.50 pro 1 Mio. Token. Bei den Zahlen handelt es sich um illustrative Demodaten.
Universelle Textgenerierung, Chat, Zusammenfassung und Content-Workloads, bei denen umfassende Funktionalität und niedrige Kosten am wichtigsten sind.
llama-3.1-nemotron-ultra-253b-v1 unterstützt bis zu einem 131K-Token-Kontextfenster – groß genug für lange Dokumente und längere Konversationen in einer einzigen Anfrage.
Innerhalb des von HotON.ai erfassten Bestands ist llama-3.1-nemotron-ultra-253b-v1 beim Eingabepreis günstiger als 40% der Modelle und liegt nach Gesamteffizienz auf Platz 179 von 535.
Ja – minimax-m2.1 ist eine kostengünstigere Option bei $0.95 pro 1 Million Ausgabe-Tokens, deckt aber dennoch ähnliche Text-Anwendungsfälle ab. Vergleichen Sie sie nebeneinander auf HotON.ai.
Bereit zum Einfügen in Artikel, Papiere oder KI-Eingabeaufforderungen – Preise und Datum werden mit den Live-Daten aktualisiert.
HotON.ai — llama-3.1-nemotron-ultra-253b-v1 (NVIDIA): $0.60/1M input, $1.80/1M output, as of 2026-05-11. https://hoton.ai/de/models/nvidia-llama-3-1-nemotron-ultra-253b-v1Die Preise sind real (über den TestKey-Katalog, täglich aktualisiert). Qualität (Arena Elo) ist real, wenn das Modell auf der LMArena-Rangliste steht. Effizienz ist eine modellierte Kombination aus realem Preis und Kontext.