综合价格、上下文与效率,nvidia/Nemotron-120B-A12B 在多数负载下整体更均衡——但最终取舍取决于你输入与输出的具体配比。
数据为示意性演示数据,不构成投资建议。
qwen3.6-flash 的输入价格更低——$0.19 vs $0.30/百万 Token——多数混合负载下它是两者中更划算的。数字为示意性演示数据。