Tencent の Hy チームは、トークンごとに 210 億のパラメーターのみをアクティブにする 2950 億の専門家混合 (MoE) モデルである Hy3 をリリースしました。これは、256K コンテキスト ウィンドウを備えた Apache 2.0 で出荷され、推論、エージェント、および長いコンテキスト タスクをターゲットとしています。
トークンの価格は、すべての AI 製品のマージンの下限を設定します。プロバイダーが価格を変更すると、競合他社、ルーティングの選択、およびすべてのダウンストリーム機能のコストに波及します。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。