语音转文字

general · 首次出现 2026-05-29 · 最近出现 2026-09-04 · 累计提及 13

综述

语音转文字近期进展

[Muse Voice Transcribe通过Meta Model API发布](https://x.com/AIatMeta/status/2094839243126243712) [Gemini 3.5 Transcribe发布](https://x.com/GoogleAI/status/2092660089509314735) [Gemini 3.5 Transcribe 语音转文字模型发布](https://x.com/googleaidevs/status/2092659736797933839) [Deepgram Nova-3 发布:通用语音转文字模型,支持单语和多语转写](https://x.com/OpenRouter/status/2080276791781097709)

当前焦点与观察点

语音转文字是将人类语音内容转换为可编辑文本的技术,在语音记录、会议转写等领域具有广泛应用。近期多家科技企业相继推出语音转文字技术的更新版本或功能升级,不同模型的参数规模、多语言支持能力成为技术竞争的重点方向,同时离线使用模式、长音频处理等实用化需求也受到行业关注。行业整体呈现出技术成熟度不断提升、应用场景不断拓展的趋势,但在设备兼容性与成本控制等方面仍存在需要完善的环节。

相关报道

10 条在档