OpenAI mengimbangi rekor ARC-AGI-3 Anthropic: GPT-5.6 Sol mendapat skor 38,3 persen, tetapi hanya dengan fitur API-nya sendiri, bukan dengan pengaturan pengujian resmi, yang modelnya mendapatkan skor 7,8 persen. ARC Prize mengklaim lingkungan pengujiannya…
Model-model baru mengatur ulang batas kemampuan dan harga-kinerja. Tim mengevaluasi kembali apa yang harus dikembangkan setiap kali peluncuran mengubah apa yang mungkin dilakukan per dolar.
Perusahaan dan model yang disebutkan dalam cerita ini — buka halaman mereka dan harga langsung
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.