قدمت أبحاث Google نظام Retrieve-for-Train (R4T)، وهو إطار عمل للبحث يعرض مجموعات نتائج متماسكة ومتنوعة. يقوم بتدريب نموذج لغة موسع مع RL مرة واحدة، باستخدام أسس التأريض والتنوع والمحاذاة.
تعمل النماذج الجديدة على إعادة ضبط حدود القدرة والأداء والسعر. تقوم الفرق بإعادة تقييم ما يجب البناء عليه عندما يؤدي الإطلاق إلى تغيير ما هو ممكن لكل دولار.
يتم تجميع الملخصات للحصول على معلومات فقط - اتبع رابط المصدر للحصول على القصة الكاملة. الإدخالات التجريبية توضيحية.