Dapatkan email saat harga campuran model ini turun. Tidak diperlukan akun.
Satu email per tetes. Berhenti berlangganan kapan saja.
Harga campuran harian ($/1 juta) — dicatat setiap hari, menjadi tren seiring berjalannya waktu.
Campuran output-to-input 3:1, per 1 juta token
Harga pada 2026-05-11 · Sumber: nvidia_reference_catalog
Pembuatan teks, obrolan, ringkasan, dan beban kerja konten untuk tujuan umum yang mengutamakan kemampuan luas dan biaya rendah.
Llama-3.1-Nemotron-Ultra-253B-v1 adalah model bahasa besar (LLM) yang dioptimalkan untuk penalaran tingkat lanjut, obrolan interaktif manusia, pengambilan-augmented generation (RAG), dan tugas pemanggilan alat. Berasal dari Meta's Llama-3.1-40...
llama-3.1-nemotron-ultra-253b-v1 adalah model Teks dari NVIDIA (US). HotON.ai melacaknya pada $0.60 per 1 juta token masukan dan $1.80 per 1 juta token keluaran, dengan jendela konteks token 131K. Skor efisiensi gabungannya adalah 89/100 dengan perkiraan $0.002 per tugas yang berhasil.
llama-3.1-nemotron-ultra-253b-v1 dilacak pada $0.60 per 1 juta token masukan dan $1.80 per 1 juta token keluaran. Beban kerja output-to-input 3:1 rata-rata berpadu menjadi $1.50 per 1 juta token. Angka adalah ilustrasi data demo.
Pembuatan teks, obrolan, ringkasan, dan beban kerja konten untuk tujuan umum yang mengutamakan kemampuan luas dan biaya rendah.
llama-3.1-nemotron-ultra-253b-v1 mendukung hingga jendela konteks token 131K — cukup besar untuk dokumen panjang dan percakapan panjang dalam satu permintaan.
Dalam rangkaian terlacak HotON.ai, llama-3.1-nemotron-ultra-253b-v1 lebih murah dibandingkan 40% model dalam hal harga input dan menempati peringkat #179 dari 535 berdasarkan efisiensi keseluruhan.
Ya — minimax-m2.7 adalah opsi berbiaya lebih rendah di $1.20 per 1 juta token keluaran, namun tetap mencakup kasus penggunaan Teks yang serupa. Bandingkan keduanya secara berdampingan di HotON.ai.
Siap untuk ditempelkan ke dalam artikel, makalah, atau permintaan AI — harga dan tanggal diperbarui dengan data langsung.
HotON.ai — llama-3.1-nemotron-ultra-253b-v1 (NVIDIA): $0.60/1M input, $1.80/1M output, as of 2026-05-11. https://hoton.ai/id/models/nvidia-llama-3-1-nemotron-ultra-253b-v1Harga nyata (melalui katalog TestKey, diperbarui setiap hari). Kualitas (Arena Elo) nyata dimana modelnya diperingkat di LMArena. Efisiensi adalah gabungan harga riil dan konteks yang dimodelkan.