Prime Intellect telah meluncurkan prime-rl 0.6.0, sebuah kerangka kerja terbuka untuk pelatihan learning pengembalian asinkron di model Mixture-of-Experts parameter triliun. Itu melatih GLM-5 pada tugas SWE dengan panjang urutan hingga 131k, dengan s…
Model-model baru mengatur ulang batas kemampuan dan harga-kinerja. Tim mengevaluasi kembali apa yang harus dikembangkan setiap kali peluncuran mengubah apa yang mungkin dilakukan per dolar.
Perusahaan dan model yang disebutkan dalam cerita ini — buka halaman mereka dan harga langsung
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.