16:08官方一手Pandaily@contact@pandaily.com (Pandaily)76°ByteDance Seed 团队发布 Seed Audio 1.0 音频生成模型,支持语音、音效和环境声的统一编排。该模型提供逐帧精度的时间轴控制,可精细调整每个音频元素的起止和混合。支持超过 20 种语言,面向电影级声音创作场景。AI模型Seed Audio 1.0ByteDance音频生成1 个信源在谈事件专题推荐理由:字节跳动新出的 Seed Audio 1.0,能对音频做精确到帧的控制,做电影级音效、语音、环境声都行,还支持20多种语言。原文稍后读已读值得跟进有用关注 Seed Audio 1.0
14:45IT之家(博客/媒体)72°字节跳动 Seed 发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声。支持精细时间控制,一条 prompt 即可按时间线编排对白、音效和环境声。支持 20+ 语种生成,大部分语言 MOS 超 4 分,可用率在多数场景达 90% 以上。已在火山方舟体验中心上线。AI模型Seed Audio 1.0字节跳动火山方舟1 个信源在谈事件专题推荐理由:字节新出的 Seed Audio 1.0 能精细控制声音时间线,还能跨 20 多种语言保持音色一致,音频可用率超 90%,做视频创作很实用。原文稍后读已读值得跟进有用关注 Seed Audio 1.0
22:42Hailuo AI@Hailuo_AIElevenLabs推出Music v2,可从场景、风格和情绪提示生成任意类型音乐。Seed Audio 1.0支持从文本、参考音频或图像生成语音,并可调节速度、音量和音高。两个模型分别面向音乐和语音生成场景。AI模型ElevenLabsMusic v2Seed Audio 1.0推荐理由:ElevenLabs同时更新了音乐和语音生成模型,Music v2能从提示生成任何风格音乐,Seed Audio 1.0支持图片转语音,玩法更多了。原文稍后读已读值得跟进有用关注 ElevenLabs
23:13berryxia@berryxia精选71°字节跳动通过BytePlus推出Seed Audio 1.0,这是一个非流式TTS模型,可在单次生成中同时输出语音、音乐和音效。该模型支持参考音频引导和图像引导音频生成,并能精细控制语速、音量、音调等参数。与仅处理语音的传统TTS不同,Seed Audio 1.0是一个多模态音频生成模型,适合复杂场景。目前仅对企业开放申请,早期反馈认为生成效果自然,但对音频时长缺乏精细控制。AI模型ByteDanceBytePlusSeed Audio 1.0推荐理由:字节跳动出了个全能音频生成模型,一次搞定语音、音乐、音效,还能用图片或参考音频引导,做短视频配乐超方便。原文稍后读已读值得跟进有用关注 ByteDance
14:48orange.ai@oran_ge豆包音频生成模型 Seed Audio 1.0 发布,可根据想象生成人声、音乐、音效和环境音。与传统的 TTS(仅文本转语音)不同,它能捕捉声音中的微妙细节。这是首次将智能赋予声音的模型,类似图像领域的 Seedance 时刻。AI产品豆包Seed Audio 1.0音频生成3 个信源在谈事件专题推荐理由:豆包发了 Seed Audio 1.0,不光能念稿,还能生成音乐和音效,像声音版的 DALL·E,值得听听。原文稍后读已读值得跟进有用关注 豆包