大規模言語モデル分野の著名なプレーヤーである DeepSeek AI は、最近、推論中の一般報酬モデル (GRM) のスケーラビリティを強化することを目的とした新しい手法を詳しく説明した研究論文を発表しました。
新しいモデルは、機能と価格パフォーマンスの最前線をリセットします。チームは、ローンチによって 1 ドルあたりの可能性が変わるたびに、何を構築するかを再評価します。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。