Menurut laporan The Information, OpenAI telah memangkas biaya inferensi untuk model AI-nya hingga lebih dari setengahnya. Perusahaan menerapkan pengoptimalan pada ChatGPT, sehingga jumlah GPU Nvidia yang dibutuhkan turun menjadi hanya beberapa…
Menghitung pasokan, energi, dan kapasitas pusat data menentukan seberapa murah AI dapat dijalankan. Pergeseran infrastruktur muncul dalam biaya inferensi beberapa minggu kemudian.
Perusahaan dan model yang disebutkan dalam cerita ini — buka halaman mereka dan harga langsung
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.