Kimi K3 (Max) 在代码和智能体测试中双料夺冠,连 GLM-5.2 都比它低一截,开发者和研究者可以关注这个新标杆。
全部动态
Cognition 把 Kimi K3 放进 Devin 桌面和终端了,在 FrontierCode 上接近前沿水平,开源模型里很能打。
Kimi 新旗舰 K3 登上 Ollama,2.8T MoE 超强视觉理解,还能直接配合 Claude Code 用,性能提升 2.5 倍每单位计算。
Kimi K3 在真实工程任务基准上拿了 58.2%,而且在 Devin 里特别擅长修 bug 和管理环境,值得做开发的看看。
Cognition 把 Kimi K3 放进 Devin 了,在 FrontierCode 上接近顶尖水平,而且是开源,想试最新的编码模型可以直接用。
Fireworks 上了首个3万亿参数的开放模型 Kimi K3,百万上下文加视觉,推理不输闭源,还零数据保留,上手试试。
Kimi K3 便宜到离谱,$3 输百万 token,推理性能还不输 Claude 和 GPT-4o,想省钱搞推理的可以试试。
月之暗面开源了 2.8 万亿参数的 Kimi K3,MoE 架构效率比 K2 高 2.5 倍,支持 100 万 token 上下文和视觉推理,值得关注。
Kimi K3 把 NVIDIA 的 Nemotron 3 Ultra 打趴了,开源模型竞争真猛,看中国实验室怎么追上来的。
SemiAnalysis证明Kimi K3比NVIDIA的Nemotron 3 Ultra强很多,开源AI竞争格局正在变化,看看谁在领跑。
硅谷近200家公司联名反对封禁中国开源模型,点名支持Kimi K3和Qwen 3.8,理由是会扼杀竞争、增加初创成本。
月之暗面新发的 Kimi K3 在知识工作跑分上干掉了 GPT-5.6 Sol,只输给 Claude Fable 5,看参数和表现都很猛。
想知道 AI 定理证明在量子计算领域到底多强?这篇论文给了两个新基准和四个模型实测分数,LAD 方法能提升最高 15.9 分,很实在。
Together Compute 下了个对比,Kimi 和 GPT 在修 bug 上各有绝活,组合用比单干划算得多。
browser_use 比赛出结果了,Kimi K3 做游戏比 Fable 便宜五倍,还能免费玩一周,感兴趣可以试试。
华为、中兴这些厂商正在抢建10万GPU级别的超节点,因为Kimi K3和GLM-5这类新模型太吃算力了,看看这场基础设施军备竞赛有多激烈。
别只盯着 token 价格了,Arize 和 Fireworks 测了 10 个模型的 2400 次 agent 运行,发现按任务难度的路由能省钱又提高成功率。Kimi K3 还追平了 GPT-5.5。
白宫说Moonshot AI 18天蒸馏出Kimi K3,技术专家直呼不可能。这事关乎开源模型存亡,初创公司都在反对。
美国科技政策官员直接点名月之暗面,说他们蒸馏了 Claude Fable 5 还偷用 GB300 芯片,这事挺劲爆的,看看具体指控是什么。