Dapatkan email saat harga campuran model ini turun. Tidak diperlukan akun.
Satu email per tetes. Berhenti berlangganan kapan saja.
Harga campuran harian ($/1 juta) — dicatat setiap hari, menjadi tren seiring berjalannya waktu.
Campuran output-to-input 3:1, per 1 juta token
Harga pada 2026-05-10 · Sumber: cerebras_official_pricing
Pembuatan teks, obrolan, ringkasan, dan beban kerja konten untuk tujuan umum yang mengutamakan kemampuan luas dan biaya rendah.
Llama 4 Scout on Cerebras adalah model pratinjau untuk inferensi model terbuka cepat.
llama-4-scout adalah model Teks dari Cerebras (US). HotON.ai melacaknya pada $0.65 per 1 juta token masukan dan $0.85 per 1 juta token keluaran, dengan jendela konteks token 8K. Skor efisiensi gabungannya adalah 88/100 dengan perkiraan $0.002 per tugas yang berhasil.
llama-4-scout dilacak pada $0.65 per 1 juta token masukan dan $0.85 per 1 juta token keluaran. Beban kerja output-to-input 3:1 rata-rata berpadu menjadi $0.80 per 1 juta token. Angka adalah ilustrasi data demo.
Pembuatan teks, obrolan, ringkasan, dan beban kerja konten untuk tujuan umum yang mengutamakan kemampuan luas dan biaya rendah.
llama-4-scout mendukung hingga jendela konteks token 8K — cukup besar untuk dokumen panjang dan percakapan panjang dalam satu permintaan.
Dalam rangkaian terlacak HotON.ai, llama-4-scout lebih murah dibandingkan 39% model dalam hal harga input dan menempati peringkat #317 dari 535 berdasarkan efisiensi keseluruhan.
Ya — deepseek-v4-flash adalah opsi berbiaya lebih rendah di $0.28 per 1 juta token keluaran, namun tetap mencakup kasus penggunaan Teks yang serupa. Bandingkan keduanya secara berdampingan di HotON.ai.
Siap untuk ditempelkan ke dalam artikel, makalah, atau permintaan AI — harga dan tanggal diperbarui dengan data langsung.
HotON.ai — llama-4-scout (Cerebras): $0.65/1M input, $0.85/1M output, as of 2026-05-10. https://hoton.ai/id/models/cerebras-llama-4-scoutHarga nyata (melalui katalog TestKey, diperbarui setiap hari). Kualitas (Arena Elo) nyata dimana modelnya diperingkat di LMArena. Efisiensi adalah gabungan harga riil dan konteks yang dimodelkan.