11:28小互@imxiaohu72°通义发布了图像生成模型Qwen-Image-3.0,支持单条指令生成九张信息图或一整版报纸。该模型原生渲染12国语言,覆盖100+艺术风格,并可仿真网页游戏直播界面。它还能联网获取最新世界知识,指令上限提升至4.5k token,一次交代完整复杂内容。AI模型Qwen-Image-3.0通义图像生成推荐理由:通义新模型Qwen-Image-3.0来了,能一次性画九张信息图甚至整版报纸,支持12国语言和100多种艺术风格,指令上限4.5k token,复杂需求一次搞定。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0
16:52小互@imxiaohu76°通义推出 Qwen-Audio-3.0-TTS 语音模型,支持 16 种语言和 20 种方言。首包延迟仅 300 毫秒级。同一段参考音可跨 16 种语言保持音色一致。在 CV3-Eval 基准上,说话人相似度 16 个语种全部排第一,Plus 平均得分 82.75 分(百分制)。AI模型Qwen-Audio-3.0-TTS通义语音合成推荐理由:通义新出的语音模型,一段音就能说16种语言,还能保持音色,延迟才300毫秒,挺实用的。原文稍后读已读值得跟进有用关注 Qwen-Audio-3.0-TTS