يختبر PerceptionBench الخاص بـ Moonshot AI مدى قدرة نماذج الذكاء الاصطناعي متعددة الوسائط على "الرؤية" بشكل منفصل عن التفكير المنطقي. لا يوجد نموذج حدودي يصل إلى دقة تصل إلى 60 بالمائة، ويتقدم GPT-5.6 Sol بفارق ضئيل. افتراضات كثيرة…
تعمل النماذج الجديدة على إعادة ضبط حدود القدرة والأداء والسعر. تقوم الفرق بإعادة تقييم ما يجب البناء عليه عندما يؤدي الإطلاق إلى تغيير ما هو ممكن لكل دولار.
الشركات والنماذج المذكورة في هذه القصة – افتح صفحاتها وأسعارها الحية
يتم تجميع الملخصات للحصول على معلومات فقط - اتبع رابط المصدر للحصول على القصة الكاملة. الإدخالات التجريبية توضيحية.