Tim MiMo Xiaomi, dengan TileRT, merilis MiMo-V2.5-Pro-UltraSpeed, mode penyajian untuk model MiMo-V2.5-Pro. Ini menerjemahkan lebih dari 1000 token per detik pada model 1 triliun parameter menggunakan satu node komoditas 8-GPU.…
Menghitung pasokan, energi, dan kapasitas pusat data menentukan seberapa murah AI dapat dijalankan. Pergeseran infrastruktur muncul dalam biaya inferensi beberapa minggu kemudian.
Perusahaan dan model yang disebutkan dalam cerita ini — buka halaman mereka dan harga langsung
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.