最も優れたAIモデルでも現実の知識労働では失敗し、タスクの3%しか解決できません。この記事「新しい基準でAIが現実の知識労働でどれだけ苦戦しているかが明らかになる」はThe Decoderに最初に掲載されました。
新しいモデルは、機能と価格パフォーマンスの最前線をリセットします。チームは、ローンチによって 1 ドルあたりの可能性が変わるたびに、何を構築するかを再評価します。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。