08:03IT之家(博客/媒体)82°微软7月23日推出两款自研模型MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进入公开预览。MAI-Image-2.5-Pro是微软精度最高的图像模型,文本输入每百万tokens 5美元,图像输出每百万tokens 106美元。MAI-Voice-2-Flash速度比MAI-Voice-2提升2倍,成本降低32%,定价每百万字符15美元。两款模型已用于Bing Image Creator、PowerPoint和OneDrive,其中MAI-Image-2.5相比GPT-Image-2降低GPU成本84%。MAI-Voice-2-Flash已接入Dynamics 365 Contact Center,可降低GPU成本89%。AI模型MAI-Image-2.5-ProMAI-Voice-2-Flash微软2 个信源在谈事件专题推荐理由:微软自己训练的新图像和语音模型,不用别人蒸馏,已经在Bing和PPT里用了,GPU成本降了八成多,价格也公开了。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
02:51OpenRouter@OpenRouterAI微软AI在OpenRouter平台发布两个新模型。MAI-Image-2.5-Pro是其目前为止最高保真度的图像生成模型。MAI-Voice-2-Flash专为高容量、实时语音交互场景设计。两个模型现已可通过OpenRouter API调用。AI模型MAI-Image-2.5-ProMAI-Voice-2-FlashOpenRouter2 个信源在谈事件专题推荐理由:微软新模型上线OpenRouter,图像更清晰,语音更实时,适合开发者和创作者试玩。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
02:50OpenRouter@OpenRouterAIOpenRouter 上线了微软的 MAI-Voice-2-Flash 模型,相比前代 MAI-Voice-2 推理速度提升2倍。该模型支持15种语言,保持自然韵律和声学质量,并提供细粒度语调控制。专为响应式语音助手和实时交互场景设计。AI模型MAI-Voice-2-FlashOpenRouter微软推荐理由:需要更快更自然的语音合成?微软新模型速度快两倍,15种语言随意切换,适合搭实时语音Agent。原文稍后读已读值得跟进有用关注 MAI-Voice-2-Flash
01:20Mustafa Suleyman@mustafasuleyman72°微软发布MAI-Voice-2-Flash,相比MAI-Voice-2推理速度快2倍。定价为每100万字符15美元,成本降低32%。该模型已集成到Dynamics 365 Contact Center,可为呼叫中心减少高达89%的GPU成本。目前处于公开预览阶段。AI模型MAI-Voice-2-FlashMicrosoftDynamics 365推荐理由:微软新语音模型MAI-Voice-2-Flash,跑得快还便宜32%,支撑企业呼叫中心,GPU成本能砍89%。原文稍后读已读值得跟进有用关注 MAI-Voice-2-Flash