事件专题 · 官方一手

Google发布Gemini 3.5 Transcribe语音转文本模型

Google推出Gemini 3.5 Transcribe语音转文本模型,分为流式和非流式两个端点。流式端点实现亚秒级转录,但省去说话人分离和词级时间戳功能,错误率为4.0%。非流式端点保留所有功能,错误率为2.6%,成本仅为流式的一半。该模型在85种以上语言中表现优异,最终处理速度比Chirp 3快70%。

当前结论

Google新发布的Gemini 3.5 Transcribe支持85种语言,错误率低至2.6%,还提供两种端点选择,适合语音助手和转录管道使用。

6 个信源78° AI 热度最后更新 2026/8/28 05:00:38

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情