Dapatkan email saat harga campuran model ini turun. Tidak diperlukan akun.
Satu email per tetes. Berhenti berlangganan kapan saja.
Harga campuran harian ($/1 juta) — dicatat setiap hari, menjadi tren seiring berjalannya waktu.
Campuran output-to-input 3:1, per 1 juta token
Harga pada 2026-05-11 · Sumber: nvidia_reference_catalog
Pembuatan teks, obrolan, ringkasan, dan beban kerja konten untuk tujuan umum yang mengutamakan kemampuan luas dan biaya rendah.
Llama-3.3-Nemotron-Super-49B-v1.5 adalah model penalaran/obrolan dengan parameter 49B dan berpusat pada bahasa Inggris yang berasal dari Llama-3.3-70B-Instruct Meta dengan konteks 128K. Ini adalah pasca-pelatihan untuk alur kerja agen (RAG, pemanggilan alat) ...
llama-3.3-nemotron-super-49b-v1.5 adalah model Teks dari NVIDIA (US). HotON.ai melacaknya pada $0.10 per 1 juta token masukan dan $0.40 per 1 juta token keluaran, dengan jendela konteks token 131K. Skor efisiensi gabungannya adalah 89/100 dengan perkiraan $0.000 per tugas yang berhasil.
llama-3.3-nemotron-super-49b-v1.5 dilacak pada $0.10 per 1 juta token masukan dan $0.40 per 1 juta token keluaran. Beban kerja output-to-input 3:1 rata-rata berpadu menjadi $0.33 per 1 juta token. Angka adalah ilustrasi data demo.
Pembuatan teks, obrolan, ringkasan, dan beban kerja konten untuk tujuan umum yang mengutamakan kemampuan luas dan biaya rendah.
llama-3.3-nemotron-super-49b-v1.5 mendukung hingga jendela konteks token 131K — cukup besar untuk dokumen panjang dan percakapan panjang dalam satu permintaan.
Dalam rangkaian terlacak HotON.ai, llama-3.3-nemotron-super-49b-v1.5 lebih murah dibandingkan 79% model dalam hal harga input dan menempati peringkat #155 dari 535 berdasarkan efisiensi keseluruhan.
Ya — deepseek/deepseek-v4-flash adalah opsi berbiaya lebih rendah di $0.28 per 1 juta token keluaran, namun tetap mencakup kasus penggunaan Teks yang serupa. Bandingkan keduanya secara berdampingan di HotON.ai.
Siap untuk ditempelkan ke dalam artikel, makalah, atau permintaan AI — harga dan tanggal diperbarui dengan data langsung.
HotON.ai — llama-3.3-nemotron-super-49b-v1.5 (NVIDIA): $0.10/1M input, $0.40/1M output, as of 2026-05-11. https://hoton.ai/id/models/nvidia-llama-3-3-nemotron-super-49b-v1-5Harga nyata (melalui katalog TestKey, diperbarui setiap hari). Kualitas (Arena Elo) nyata dimana modelnya diperingkat di LMArena. Efisiensi adalah gabungan harga riil dan konteks yang dimodelkan.