PolyAI は、ASR トランスクリプトを読み取る代わりに発信者の音声を直接認識するダイアログ モデルである Dialog-RSN-1 を導入しました。ターンテイキング、音声認識、関数呼び出し、応答生成を 1 つのシステムに融合します。
新しいモデルは、機能と価格パフォーマンスの最前線をリセットします。チームは、ローンチによって 1 ドルあたりの可能性が変わるたびに、何を構築するかを再評価します。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。