قامت OpenAI بتدريب GPT-Red، وهو نموذج مهاجم داخلي فقط، باستخدام التعلم المعزز باللعب الذاتي ضد مجموعة من المدافعين LLMs. لقد تغلب على أعضاء الفريق الأحمر البشري بنسبة 84% إلى 13% في ساحة الحقن الفوري غير المباشر المكررة...
تعمل النماذج الجديدة على إعادة ضبط حدود القدرة والأداء والسعر. تقوم الفرق بإعادة تقييم ما يجب البناء عليه عندما يؤدي الإطلاق إلى تغيير ما هو ممكن لكل دولار.
يتم تجميع الملخصات للحصول على معلومات فقط - اتبع رابط المصدر للحصول على القصة الكاملة. الإدخالات التجريبية توضيحية.