Amazon SageMaker AI 上の G5、G6、G6e、G7 GPU インスタンス全体で、2 つの 30B Mixture-of-Experts モデル、Qwen3-Coder-30B と NVIDIA Nemotron-3-Nano-30B をベンチマークします。スループット、レイテンシ、トークンあたりのコストを比較して、その結果を確認してください。
トークンの価格は、すべての AI 製品のマージンの下限を設定します。プロバイダーが価格を変更すると、競合他社、ルーティングの選択、およびすべてのダウンストリーム機能のコストに波及します。
この記事で言及されている企業とモデル - ページを開いて実際の価格を確認してください
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。