Google sedang mengembangkan "Frozen v2", sebuah chip server yang memasukkan arsitektur Gemini langsung ke dalam perangkat keras. Menurut sumber internal, TPU ini bisa 6 hingga 10 kali lebih efisien dibandingkan TPU yang ada saat ini. Dijadwalkan pada tahun 2028,…
Menghitung pasokan, energi, dan kapasitas pusat data menentukan seberapa murah AI dapat dijalankan. Pergeseran infrastruktur muncul dalam biaya inferensi beberapa minggu kemudian.
Perusahaan dan model yang disebutkan dalam cerita ini — buka halaman mereka dan harga langsung
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.