事件专题 ·多源确认

GitHub Copilot 支持本地推理,微软发布 MAI Code 1.1 Flash

微软在 10 月 7 日旧金山发布会上宣布,GitHub Copilot 将在本月底前支持本地 AI 模型推理,开发者可在 Visual Studio Code、CLI 与 Copilot 应用中让协调器在云端模型和设备端模型之间自动或手动切换。配套发布的 MAI Code 1.1 Flash 是总参数 1370 亿、活跃参数 68 亿的 MoE 模型,经量化与推测解码优化。在 Surface Laptop Ultra 上的解码吞吐量测试显示,提示长度从 2K 到 256K 词元时吞吐为每秒 40 至 63 词元。本地模型可通过 Windows ML 加载,也支持连接 OpenAI 兼容端点。

当前结论

微软给 GitHub Copilot 加了本地推理,新模型 MAI Code 1.1 Flash 在 Surface Laptop Ultra 上能跑到每秒 63 词元,写代码没网也能用。

11 个信源64° AI 热度最后更新 2026/10/7 22:17:08

证据链

11 个信源
相关来源 8Vaibhav Srivastav
查看原文
相关来源 9Dylan Patel (SemiAnalysis)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。