#Anthropic
Anthropic 的 Claude Opus 5 在真实编程和文本推理任务上跑赢了多数竞品,想看看新模型实力的可以关注这个榜单。
有个用户觉得Claude没以前好用了,现在更喜欢Grok和Kimi,还发现Anthropic和OpenAI都在押注RL而不是RLHF,挺有意思的观察。
Anthropic对开源AI的态度浮出水面,一边说不禁止,一边提三个条件,包括限制中国芯片和强制安全测试,值得关注他们怎么平衡开源和安全。
Anthropic CEO 正面回应了 NVIDIA 等公司支持的开放权重公开信,给出了三个具体管制建议,和 OpenAI 等对手的立场形成对比。
Anthropic CEO亲自解释了为啥不签那个支持开源AI的公开信,核心观点是安全测试比开放权重更重要,别错过这个关键立场。
Anthropic 的 Claude Cowork 被曝高危漏洞,能逃逸虚拟机读写你 Mac 任意文件,影响约 50 万用户。用本地版的赶紧改配置吧。
Anthropic 出了 Opus 5,接近 Fable 5 的能力但便宜一半,agent 编程和知识工作更强,快去 Poe 试试。
Anthropic 的 Claude Opus 5 在多个 Arena 基准上拿了第一,价格还比 Fable 5 便宜一半。做前端编码或文档推理的朋友可以重点关注。
Anthropic开源了一套金融分析智能体方案,这篇教程手把手教你用Claude和Python搭建,还能自动解析技能文件,适合搞量化分析的人试试。
微软的新安全模型MAI-Cyber-1-Flash,比Anthropic Mythos高出12个点,成本还减半,搞网络安全的可以盯着。
Anthropic 的 Claude Code 之父 Boris Cherny 在 YC Startup School 上揭秘 Opus 5 的新特性,还分享了删除 80% 系统提示的实战经验。想了解下一代模型和 Agent 构建思路?这视频干货十足。
这条推文直指 Opus 5 和 Fable 5 的基准与体验反差,还爆出 Anthropic 新的蒸馏训练路径,以及 RLHF 被弱化导致的体验变化,值得看看。
欧盟要干掉烦人的Cookie弹窗,但谷歌不乐意;Anthropic发现Claude 5太聪明不用管太多;Ruff规则翻了7倍;8美元芯片就能跑AI模型,这些都很值得看。
Anthropic产品负责人亲口讲从5人团队到推出Mythos的经历,全是模型开发、评估和安全的内部视角,产品经理和AI从业者别错过。