PerceptionBench dari Moonshot AI menguji seberapa baik model AI multimodal benar-benar dapat "melihat", terlepas dari penalaran logis. Tidak ada model frontier yang mencapai akurasi 60 persen, dan GPT-5.6 Sol memimpin dengan selisih tipis. Banyak anggapan…
Model-model baru mengatur ulang batas kemampuan dan harga-kinerja. Tim mengevaluasi kembali apa yang harus dikembangkan setiap kali peluncuran mengubah apa yang mungkin dilakukan per dolar.
Perusahaan dan model yang disebutkan dalam cerita ini — buka halaman mereka dan harga langsung
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.