このモデルのブレンド価格が下がったときにメールを受け取ります。アカウントは必要ありません。
ドロップごとに 1 つのメール。いつでも購読を解除してください。
毎日の混合価格 ($/100 万) — 毎日記録され、時間の経過とともにトレンドが形成されます。
一般的な 3:1 の出力と入力の組み合わせ (1M トークンあたり)
2026-05-11 時点の価格 · ソース: nvidia_reference_catalog
幅広い機能と低コストが最も重要な汎用テキスト生成、チャット、要約、およびコンテンツのワークロード。
Llama-3.1-Nemotron-Ultra-253B-v1は、高度な推論、人間との対話、リトリーブアUGメント生成(RAG)、ツール呼び出しタスク向けに最適化された大規模言語モデル(LLM)です。MetaのLlama-3.1-40から派生しています...
llama-3.1-nemotron-ultra-253b-v1 は NVIDIA (US) の 文章 モデルです。 HotON.ai は、131K トークン コンテキスト ウィンドウを使用して、1M 入力トークンあたり $0.60 および 1M 出力トークンあたり $1.80 で追跡します。複合効率スコアは、成功したタスクごとの推定 $0.002 で 89/100 です。
llama-3.1-nemotron-ultra-253b-v1 は、1M 入力トークンごとに $0.60 で追跡され、1M 出力トークンごとに $1.80 で追跡されます。一般的な 3:1 の出力と入力のワークロードは、100 万トークンあたりおよそ $1.50 にブレンドされます。図はデモデータの例です。
幅広い機能と低コストが最も重要な汎用テキスト生成、チャット、要約、およびコンテンツのワークロード。
llama-3.1-nemotron-ultra-253b-v1 は最大 131K トークン コンテキスト ウィンドウをサポートします。これは、単一のリクエストで長いドキュメントや長時間の会話を処理するのに十分な大きさです。
HotON.ai 追跡セット内では、llama-3.1-nemotron-ultra-253b-v1 は入力価格でモデルの 40% より安く、全体的な効率で 535 の #179 にランクされます。
はい — minimax-m2.7 は、同様の 文章 ユースケースをカバーしながら、1M 出力トークンあたりの $1.20 の低コスト オプションです。 HotON.ai で並べて比較してください。
記事、論文、または AI プロンプトに貼り付ける準備ができています。価格と日付はライブ データで更新されます。
HotON.ai — llama-3.1-nemotron-ultra-253b-v1 (NVIDIA): $0.60/1M input, $1.80/1M output, as of 2026-05-11. https://hoton.ai/ja/models/nvidia-llama-3-1-nemotron-ultra-253b-v1価格は実際のものです (毎日更新される TestKey カタログ経由)。 LMArena でモデルがランク付けされる品質 (Arena Elo) は本物です。効率は、実際の価格と状況を組み合わせてモデル化されたものです。