Google 发布了 Gemini 3.5 Transcribe,这是一种语音到文本模型,作为两个独立的端点而不是一个端点提供。流媒体端点提供亚秒级转录,但会丢弃说话者分类和单词时间……
新模型会重置能力与性价比的前沿。每次发布改变「每美元能做什么」,团队就要重新评估该基于哪个模型构建。
本文提及的厂商与模型 —— 打开它们的页面与实时价格
相关 HotON.ai 页面
摘要仅供参考,请点击来源链接查看全文。演示条目为示意。