月之暗面的 Kimi K3.1 曝光了,会有 Low/High/Max 三档推理和 Swarm 多智能体协作,10 月见分晓。
月之暗面Moonshot AI
中国·Beijing
Kimi 助手与 Kimi K 系列模型
在做什么
月之暗面 2023 年在北京成立,开发 Kimi 智能助手和 Kimi K 系列大模型,K 系列主打长上下文和开放权重的智能体能力。
最近动态
信息流里提到这家公司的条目消息称月之暗面 Kimi K3.1 下月发布,支持三档推理强度
IT之家原文
Fireworks 发布 Ember-1:基于 Kimi K3 减少 40% 推理 token
Fireworks 在 Kimi K3 上做了个减法:推理 token 少用 40% 但质量不掉,跑推理烧钱的朋友可以看看。
Step 5 Preview 实测:发动机动画与三维抓娃娃机两个编程任务对比
Step 5 Preview 刚发布,作者拿发动机动画和3D抓娃娃机两个任务实测它,和 GLM-5.3、DeepSeek-V4.1-Flash、GPT-5.6 Sol 逐项对比耗时和成品质量,比看跑分实在。
StepFun 开源 Step Code,Terminal-Bench 2.1 得分 80.9%
StepFun 把自家 Coding Agent 开源了,跑分还行,作者顺手整理了国内各家开源编程 Agent 的 GitHub 链接,选型可以直接抄。
CliffCompaction:让长程编程智能体的上下文压缩成本降低最多 50%
这篇讲了怎么把智能体跑长任务的 token 开销砍一半,方法只有一条:压缩只删不改,还开源了能在 Claude Code 里直接用的实现。
浪潮信息发布 MetaBrain SD200 Ultra:128 颗国产芯片跑 Kimi K3,延迟 5.85ms/token
浪潮信息出了台 128 颗国产芯片的超节点,实测能跑 2.8 万亿参数的 Kimi K3,每 token 延迟 5.85 毫秒以内,国产算力堆叠挺猛的。
阿里:Qwen4 已开训,后续版本将扩至 5-10T 参数,新视频模型 11 月发
Qwen4 已开训,参数要扩到 5-10T;Qwen3.8-Max 没人参与自己迭代 33 轮,得分追平 Claude、GPT。
IT之家原文
浪潮发布元脑 SD200 Ultra 超节点:单机跑 Kimi K3,时延 5.85 毫秒
国产芯片一台机器跑下 2.8 万亿参数的 Kimi K3,出字速度做到业界平均 5 倍,做推理部署的可以看看这套规格。
IT之家原文
小米开源全模态模型 MiMo-V2.6:AA 指数 46 分超 Kimi K3
小米把 MiMo-V2.6 权重全开源了,Pro 在 AA 指数拿 46 分压过 Kimi K3,价格只有海外模型的 1/20。
IT之家原文