对 Amazon SageMaker AI 上的 G5、G6、G6e 和 G7 GPU 实例的两个 30B Mixture-of-Experts 模型 Qwen3-Coder-30B 和 NVIDIA Nemotron-3-Nano-30B 进行基准测试。比较吞吐量、延迟和每个令牌的成本,看看如何……
Token 价格决定了每个 AI 产品的利润下限。厂商一调价,就会波及竞争对手、路由选择和每个下游功能的成本。
本文提及的厂商与模型 —— 打开它们的页面与实时价格
摘要仅供参考,请点击来源链接查看全文。演示条目为示意。