SemiAnalysis证明Kimi K3比NVIDIA的Nemotron 3 Ultra强很多,开源AI竞争格局正在变化,看看谁在领跑。
全部动态
Together Compute 下了个对比,Kimi 和 GPT 在修 bug 上各有绝活,组合用比单干划算得多。
browser_use 比赛出结果了,Kimi K3 做游戏比 Fable 便宜五倍,还能免费玩一周,感兴趣可以试试。
别只盯着 token 价格了,Arize 和 Fireworks 测了 10 个模型的 2400 次 agent 运行,发现按任务难度的路由能省钱又提高成功率。Kimi K3 还追平了 GPT-5.5。
白宫说Moonshot AI 18天蒸馏出Kimi K3,技术专家直呼不可能。这事关乎开源模型存亡,初创公司都在反对。
美国科技政策官员直接点名月之暗面,说他们蒸馏了 Claude Fable 5 还偷用 GB300 芯片,这事挺劲爆的,看看具体指控是什么。
美国科技顾问直接点名Moonshot AI偷学Anthropic的Fable造Kimi K3,K3最近成绩逼近前沿,但背后是蒸馏争议,这场中美AI摩擦值得关注。
Fireworks 用1000个智能体任务实测了 Kimi K3 和 Fable,发现按任务路由能省50倍成本,还能保持93%准确率。K3 在安全和长循环上更强。
实测Kimi K3确实强,但烧token也快。作者分享了用claude-context省40% token的实操,适合搞智能体的团队参考。
想知道 GPT 5.6 SOL 和 Kimi K3 在视频生成上有多大差别?同一个提示词,两个 AI 导演各拍一版,看完你就懂了。
杨植麟从Transformer-XL、XLNet到Kimi K3,只用16个专家就做到1M上下文,值得看看他的思路。
Inkling是当前美国最强的开源模型,在Agent Arena排第9,擅长处理复杂工作流和CLI错误恢复,但用户反馈一般,你可以试试看它是否适合你。
这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
中国开源模型Kimi K3编码能力比Claude和GPT还强,价格却便宜好几倍,做长上下文编程选它准没错。
SpaceXAI 的 Grok 4.5 用 $0.31 就干到一流水平,比 Claude 便宜 9 倍,token 还省 6 倍,省钱党可以关注。