Erhalten Sie eine E-Mail, wenn der Mischpreis dieses Modells sinkt. Kein Konto erforderlich.
Eine E-Mail pro Drop. Abmelden jederzeit möglich.
Täglicher gemischter Preis ($/1 Mio.) – wird jeden Tag aufgezeichnet und bildet im Laufe der Zeit einen Trend.
Typischer 3:1-Output-to-Input-Mix pro 1 Mio. Token
Preis ab 2026-05-11 · Quelle: nvidia_reference_catalog
Universelle Textgenerierung, Chat, Zusammenfassung und Content-Workloads, bei denen umfassende Funktionalität und niedrige Kosten am wichtigsten sind.
NVIDIA's Llama 3.1 Nemotron 70B ist ein Sprachmodell, das für die Generierung präziser und nützlicher Antworten konzipiert ist. Es nutzt die Architektur von Llama 3.1 70B und das Verstärkungslernen aus menschlichem Feedback (RLHF), was es hervorragend...
llama-3.1-nemotron-70b-instruct ist ein Text-Modell von NVIDIA (US). HotON.ai verfolgt es bei $1.20 pro 1 Mio. Eingabe-Tokens und $1.20 pro 1 Mio. Ausgabe-Tokens mit einem 131K-Token-Kontextfenster. Sein zusammengesetzter Effizienzwert beträgt 89/100 bei einem geschätzten $0.003 pro erfolgreicher Aufgabe.
llama-3.1-nemotron-70b-instruct wird bei $1.20 pro 1 Mio. Eingabe-Tokens und $1.20 pro 1 Mio. Ausgabe-Tokens verfolgt. Eine typische 3:1-Ausgabe-zu-Eingabe-Arbeitslast ergibt ungefähr $1.20 pro 1 Mio. Token. Bei den Zahlen handelt es sich um illustrative Demodaten.
Universelle Textgenerierung, Chat, Zusammenfassung und Content-Workloads, bei denen umfassende Funktionalität und niedrige Kosten am wichtigsten sind.
llama-3.1-nemotron-70b-instruct unterstützt bis zu einem 131K-Token-Kontextfenster – groß genug für lange Dokumente und längere Konversationen in einer einzigen Anfrage.
Innerhalb des von HotON.ai erfassten Bestands ist llama-3.1-nemotron-70b-instruct beim Eingabepreis günstiger als 25% der Modelle und liegt nach Gesamteffizienz auf Platz 234 von 535.
Ja – minimax-m2.1 ist eine kostengünstigere Option bei $0.95 pro 1 Million Ausgabe-Tokens, deckt aber dennoch ähnliche Text-Anwendungsfälle ab. Vergleichen Sie sie nebeneinander auf HotON.ai.
Bereit zum Einfügen in Artikel, Papiere oder KI-Eingabeaufforderungen – Preise und Datum werden mit den Live-Daten aktualisiert.
HotON.ai — llama-3.1-nemotron-70b-instruct (NVIDIA): $1.20/1M input, $1.20/1M output, as of 2026-05-11. https://hoton.ai/de/models/nvidia-llama-3-1-nemotron-70b-instructDie Preise sind real (über den TestKey-Katalog, täglich aktualisiert). Qualität (Arena Elo) ist real, wenn das Modell auf der LMArena-Rangliste steht. Effizienz ist eine modellierte Kombination aus realem Preis und Kontext.