事件专题 ·多源确认

Google 开放 Gemini API 逐行微调语音合成,含 SynthID 水印

Google DeepMind 宣布开发者可通过 Gemini API 使用语音生成功能。用户能逐行微调台词的节奏、情绪,并加入笑声、停顿等提示。所有生成音频均带 SynthID 水印,可被识别为 AI 生成内容。开发可在 Google AI Studio 中上手。

当前结论

Google 在 Gemini API 里开放了逐行调语气的语音生成,能控制节奏、情绪甚至笑声停顿,还自带 SynthID 水印,做语音产品的可以去 AI Studio 试试。

3 个信源58° AI 热度最后更新 2026/9/23 15:25:59

证据链

3 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。