Moonshot AI'nin PerceptionBench'i, çok modlu yapay zeka modellerinin mantıksal akıl yürütmeden ayrı olarak gerçekte ne kadar iyi "görebildiğini" test ediyor. Hiçbir öncü model yüzde 60 doğruluğa ulaşamaz ve GPT-5.6 Sol dar bir farkla öndedir. Pek çokları sanırım…
Yeni modeller kapasite ve fiyat-performans sınırını sıfırlıyor. Ekipler, bir lansman dolar başına mümkün olanı değiştirdiğinde neyin üzerine inşa edileceklerini yeniden değerlendiriyor.
Bu hikayede adı geçen şirketler ve modeller — sayfalarını açın ve canlı fiyatları
Özetler yalnızca bilgi amaçlı olarak toplanmıştır; hikayenin tamamı için kaynak bağlantısını takip edin. Demo girişleri örnek niteliğindedir.