全部动态
Perplexity 把 Kimi K3 放进来了,Pro/Max 用户现在能在搜索和电脑模式直接用,服务器还在美国,速度应该不错。
Code Arena 刚上线了全栈能力排行榜,Kimi K3 拿了第一,GPT 5.6 和 Claude Fable 紧随其后,想比模型写代码能力的可以看看。
Anthropic 的 Claude Opus 5 刚发布就刷榜,在编码和文本两个任务上超过了之前很火的 Kimi K3,值得关注。
Anthropic 的 Claude Opus 5 在真实编程和文本推理任务上跑赢了多数竞品,想看看新模型实力的可以关注这个榜单。
团队用不同 AI 工具的话,Nexus 能让它们跑一个平台:自动选模型、控成本,还不改工作方式,省心省力。
Anthropic 的 Claude Opus 5 在多个 Arena 基准上拿了第一,价格还比 Fable 5 便宜一半。做前端编码或文档推理的朋友可以重点关注。
Kimi K3在Fireworks上刚上线,3万亿参数、1M上下文、原生视觉,性能不输Opus但便宜好几倍,做高性价比推理就选它。
Kimi 开源了 K3 模型,Agent Arena 直接干翻 GLM-5.2,净提升超 9%,代码和文本竞技场也是第一,值得关注。
Kimi K3 (Max) 在代码和智能体测试中双料夺冠,连 GLM-5.2 都比它低一截,开发者和研究者可以关注这个新标杆。
Cognition 把 Kimi K3 放进 Devin 桌面和终端了,在 FrontierCode 上接近前沿水平,开源模型里很能打。
Kimi 新旗舰 K3 登上 Ollama,2.8T MoE 超强视觉理解,还能直接配合 Claude Code 用,性能提升 2.5 倍每单位计算。
Kimi K3 在真实工程任务基准上拿了 58.2%,而且在 Devin 里特别擅长修 bug 和管理环境,值得做开发的看看。
Cognition 把 Kimi K3 放进 Devin 了,在 FrontierCode 上接近顶尖水平,而且是开源,想试最新的编码模型可以直接用。
Fireworks 上了首个3万亿参数的开放模型 Kimi K3,百万上下文加视觉,推理不输闭源,还零数据保留,上手试试。
Kimi K3 便宜到离谱,$3 输百万 token,推理性能还不输 Claude 和 GPT-4o,想省钱搞推理的可以试试。
Kimi K3 把 NVIDIA 的 Nemotron 3 Ultra 打趴了,开源模型竞争真猛,看中国实验室怎么追上来的。