事件专题 ·多源确认

微软发布 Microsoft-Decision-1:基于 Qwen3.5-9B 的单次前向传播决策模型

微软推出 Microsoft-Decision-1,基于 Qwen3.5-9B 后训练,专门优化单次前向传播的决策打分,可做是非判断、多选、评分和评分卡式回答审核。这类模型用于 Agent 工作流中的路由、分类、审核等串行判断:20 步决策若每步多 100ms,整体就慢 2 秒。微软称其 P50 延迟比 GPT-6 Sol 快约 35 倍,比 Quyet-1.0-Large 快 4.5 倍。定价与 Jev 相同,输入 0.042 美元,输出免费。

当前结论

微软基于 Qwen3.5-9B 出了个决策小模型,专管 Agent 流程里的判断打分,比 GPT-6 Sol 快 35 倍,输出还免费。

7 个信源43° AI 热度最后更新 2026/10/9 23:04:50

证据链

7 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。