AMD は、Instinct MI300X および MI325X GPU でゼロからトレーニングされた完全にオープンな Mixture-of-Experts 言語モデルである Instella-MoE-16B-A3B をリリースしました。合計 16B のパラメーターを保持しますが、ゲート付き MLA を使用してトークンあたり 2.8B のみをアクティブにします…
トークンの価格は、すべての AI 製品のマージンの下限を設定します。プロバイダーが価格を変更すると、競合他社、ルーティングの選択、およびすべてのダウンストリーム機能のコストに波及します。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。