全部动态
Claude Code 把 Auto 模式设为默认,官方测试拦下 89% 危险操作、720 次注入攻击,有第三方验证。
Anthropic 给 Claude Fable 5 的安全拦截做了次大调整,误伤少了 85%,做生物相关提问更不容易被降级了。
Simon用GPT-5.6 Sol Ultra在Codex Desktop里把浣熊抢博物馆的游戏做得比Claude Fable 5还顺,视频看着挺有意思。
作者用 Codex 和 GPT-5.6 Sol Ultra 刷出了比 Claude 版更带感的浣熊劫案游戏,还附了修 bug 实录,想看 AI 编程上限的可围观。
他拿四年前GPT-3和DALL-E编的游戏图当模板,让Claude Fable 5真把游戏做出来了,模型直接看图写代码,挺离谱的。
Simon Willison拿Claude Fable 5自动做了一整个游戏,配GitHub Pages实时预览,比2024年GPT-3时代强太多了。
Qwen3.8-Max在视觉榜单冲到第二,只比Claude Fable 5低13分,想看看国产视觉模型底子的可以关注。
网友亲测了Claude Fable 5、GPT 5.6 Sol等模型,告诉你哪个写代码靠谱、哪个写作顺手,还爆出GPT偷偷作弊的趣事。
Code Arena 刚上线了全栈能力排行榜,Kimi K3 拿了第一,GPT 5.6 和 Claude Fable 紧随其后,想比模型写代码能力的可以看看。
Kimi 开源了2.8T参数的K3模型,激活104B参数,能处理百万token上下文,视觉能力也不弱,性能直逼Claude和GPT-5.6,适合用来部署或研究。
Anthropic 出了 Opus 5,接近 Fable 5 的能力但便宜一半,agent 编程和知识工作更强,快去 Poe 试试。
月之暗面开源了 2.8 万亿参数的 Kimi K3,MoE 架构效率比 K2 高 2.5 倍,支持 100 万 token 上下文和视觉推理,值得关注。
卡帕西悄悄改了简介,网友炸了锅。这篇把他在Anthropic这68天的事儿都捋了,包括Claude Fable 5翻车、Claude Tag争议、还有没签开放权重公开信,挺有意思的。
Anthropic 新模型 Opus 5 智能接近 Fable 5 但价格减半,数据保留更灵活,适合团队用更少的钱获得顶尖推理能力。
Anthropic 的 Claude Opus 5 性能接近 Fable 5 还便宜一半,能自己写代码做 3D 重建,很强。
Anthropic新出的Claude Opus 5,定价和以前一样,能力却快赶上更贵的Fable 5了,特别适合搞AI编程和控制电脑。
月之暗面新发的 Kimi K3 在知识工作跑分上干掉了 GPT-5.6 Sol,只输给 Claude Fable 5,看参数和表现都很猛。
Claude Code 最新版换上了 Rust 写的 Bun,Linux 启动快了一截,如果你用 Linux 开发可以试试。
美国科技政策官员直接点名月之暗面,说他们蒸馏了 Claude Fable 5 还偷用 GB300 芯片,这事挺劲爆的,看看具体指控是什么。
有人把 Claude Fable 5 的思维链塞进了 MiniCPM5-1B,搞出个 657MB 的本地推理模型,128K 上下文还能看它怎么想的,部署门槛极低。
想看最强的AI在实时观察任务上有多弱吗?ActiveVision让GPT-5.5和Claude Fable 5原形毕露,人类碾压它们。
DeepSeek API 可能偷偷调用 Claude?测试者用 3D 游戏、安全题等挖出异常行为,但证据还不铁,吃瓜注意别上头。
这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
中国开源模型Kimi K3编码能力比Claude和GPT还强,价格却便宜好几倍,做长上下文编程选它准没错。
阿里开源 Qwen3.8,2.4T 参数直逼 Claude Fable 5,现在就能试 Preview 版,开源党快冲!