主要来源Google DeepMind
查看原文事件专题 ·多源确认
Google 开放 Gemini API 逐行微调语音合成,含 SynthID 水印
Google DeepMind 宣布开发者可通过 Gemini API 使用语音生成功能。用户能逐行微调台词的节奏、情绪,并加入笑声、停顿等提示。所有生成音频均带 SynthID 水印,可被识别为 AI 生成内容。开发可在 Google AI Studio 中上手。
当前结论
Google 在 Gemini API 里开放了逐行调语气的语音生成,能控制节奏、情绪甚至笑声停顿,还自带 SynthID 水印,做语音产品的可以去 AI Studio 试试。
3 个信源58° AI 热度最后更新 2026/9/23 15:25:59
证据链
3 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。