OpenAI 在其 API 中添加了两个实时模型。 GPT-Realtime-2.1-mini 是一个迷你语音推理模型,价格与早期的 gpt-realtime-mini 类似。 OpenAI 还通过改进缓存将 p95 延迟缩短了至少 25%。他…
算力供给、能源与数据中心容量决定了 AI 运行的成本。基础设施的变化会在数周后体现在推理成本上。
本文提及的厂商与模型 —— 打开它们的页面与实时价格
相关 HotON.ai 页面
摘要仅供参考,请点击来源链接查看全文。演示条目为示意。