Recevez un e-mail lorsque le prix mixte de ce modèle baisse. Aucun compte requis.
Un e-mail par dépôt. Désabonnez-vous à tout moment.
Prix mixte quotidien (1 million de dollars) — enregistré chaque jour, se transforme en tendance au fil du temps.
Mélange sortie-entrée typique 3:1, par million de jetons
Prix à partir du 2026-05-11 · Source: baseten_reference_catalog
Charges de travail de génération de texte, de chat, de synthèse et de contenu à usage général pour lesquelles une large capacité et un faible coût sont les plus importants.
Route de l'API du modèle Baseten pour Nemotron Super, ajoutant une rangée de raison longue-contexte NVIDIA avec des champs de tarification de l'API de modèle géré.
nvidia/Nemotron-120B-A12B est un modèle Texte de Baseten Model APIs (US). HotON.ai le suit à $0.30 par 1 million de jetons d'entrée et $0.75 par 1 million de jetons de sortie, avec une fenêtre contextuelle de jeton 202K. Son score d'efficacité composite est de 90/100 avec une estimation de $0.001 par tâche réussie.
nvidia/Nemotron-120B-A12B est suivi à $0.30 par 1 million de jetons d'entrée et à $0.75 par 1 million de jetons de sortie. Une charge de travail typique de 3:1 sortie-entrée se mélange à environ $0.64 pour 1 million de jetons. Les chiffres sont des données de démonstration illustratives.
Charges de travail de génération de texte, de chat, de synthèse et de contenu à usage général pour lesquelles une large capacité et un faible coût sont les plus importants.
nvidia/Nemotron-120B-A12B prend en charge jusqu'à une fenêtre contextuelle de jeton 202K — suffisamment grande pour des documents longs et des conversations étendues en une seule requête.
Dans l'ensemble suivi HotON.ai, nvidia/Nemotron-120B-A12B est moins cher que 51% des modèles en termes de prix d'entrée et se classe #95 de 535 en termes d'efficacité globale.
Oui — deepseek-v4-flash est une option moins coûteuse à $0.28 par 1 million de jetons de sortie, tout en couvrant des cas d'utilisation similaires de Texte. Comparez-les côte à côte sur HotON.ai.
Prêt à coller dans des articles, des articles ou des invites d'IA : les prix et la date sont actualisés avec les données en direct.
HotON.ai — nvidia/Nemotron-120B-A12B (Baseten Model APIs): $0.30/1M input, $0.75/1M output, as of 2026-05-11. https://hoton.ai/fr/models/baseten-nvidia-nemotron-120b-a12bLe prix est réel (via le catalogue TestKey, mis à jour quotidiennement). La qualité (Arena Elo) est réelle là où le modèle est classé sur LMArena. L’efficacité est un composite modélisé du prix réel et du contexte.