英国 AI セキュリティ研究所の研究者らは、心理測定手法を使用して、言語モデルの一般的な安全性ベンチマークが 1 つの一貫した特性を測定していないことを示しました。リクエストを全面的にブロックすると、人為的にリクエストが膨らむ可能性があります…
新しいモデルは、機能と価格パフォーマンスの最前線をリセットします。チームは、ローンチによって 1 ドルあたりの可能性が変わるたびに、何を構築するかを再評価します。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。