8月24日
18:53
18:53AI Will@FinanceYF5
78°
Anthropic最强模型Fable 5仅占客户购买Token的6%,价格是Opus 5的两倍,但性能仅落后0.5%,单任务成本减半。企业主要在高难度任务上使用Fable 5,成本更低可能带来更高毛利。
事件专题

推荐理由:Anthropic的Fable 5虽然价格高,但性能仅略逊于Opus 5,成本却低一半,适合高难度任务,值得关注。
05:03
05:03官方账号Simon Willison’s Weblog博客/媒体
78°
Anthropic的年度收入达到650亿美元,预计第三季度将盈利。尽管如此,其Opus 5模型在7月份发布后,用户增长缓慢,Ramp AI指数显示其市场份额仅为8.0%。与此同时,OpenAI的年度收入增长35%,达到400多亿美元,GPT 5.6的发布推动了公司业绩。
事件专题

推荐理由:Anthropic的Opus 5模型虽然性能强大,但因其成本较高而难以吸引用户,相比之下,OpenAI的GPT 5.6凭借较低的成本获得了更多用户。
8月21日
05:35
05:35Browser Use@browser_use
Opus 5 和 GPT-5.6 Sol 在浏览器使用基准测试中表现接近。该基准由数百名用户参与,将真实用户任务转化为测试。测试采用原子化、可验证且明确的评估标准。这是目前最好的浏览器智能体基准测试。
推荐理由:Opus 5 和 GPT-5.6 Sol 在一个新浏览器基准上打平了,这个基准是真实用户任务,评估标准很细,看看谁更会上网吧。
8月14日
8月9日
13:02
8月8日
01:58
01:58官方账号Decoder@Matthias Bastian
83°
Anthropic将Fable 5生物学安全过滤器的误报率降低了约85%。此前,几乎所有生物学相关查询都会被拦截并转交给能力较弱的Opus 5。现在,普通生物学问题可直接由Fable 5处理,但病毒学和毒理学等敏感双用途主题仍保留原有限制。
事件专题

推荐理由:Anthropic把Fable 5的生物误报砍了85%,普通生物问题不再被转给Opus 5,但病毒毒理还是管得严。
8月7日
00:28
00:28官方账号Cursor@cursor_ai
没有任何模型能在所有任务上占优:Grok 4.5 在常规任务上性价比高。GPT-5.6 Sol 擅长规划与代码库理解。Opus 5 适合执行密集型工作。Fable 5 在调试和视觉实现上更出色。
事件专题

推荐理由:选模型别纠结了:常规任务选 Grok 4.5,规划代码库找 GPT-5.6 Sol,重执行用 Opus 5,调试看 Fable 5。
8月6日
22:17
8月2日
7月28日
01:41
01:41Y Combinator@ycombinator
77°
Claude Code 创始人 Boris Cherny 在 YC Startup School 2026 上分享 Opus 5 的独特之处,包括解决提示注入和删除 80% 系统提示。他解释了为何 Claude Code 要大幅精简系统提示,以及如何利用 Opus 5 运行数千个 AI 智能体。Cherny 认为编程问题已接近解决,但 CS 学生仍需掌握基础原理。
事件专题

推荐理由:Anthropic 的 Claude Code 之父 Boris Cherny 在 YC Startup School 上揭秘 Opus 5 的新特性,还分享了删除 80% 系统提示的实战经验。想了解下一代模型和 Agent 构建思路?这视频干货十足。
7月27日
7月26日
13:31
13:31Jerry Liu@jerryjliu0
精选
Jerry Liu 分享使用 Claude Code 的经验,指出过度约束模型会导致其无法探索未知问题。他发现移除大约 80% 的 Claude Code 系统提示词后,模型能利用上下文自行判断,效果更佳。他推荐 Opus 5 模型在 Claude Code 中表现优异。
事件专题

推荐理由:别老想着给模型写满约束,Jerry Liu 发现拿掉 Claude Code 八成提示词模型反而更聪明。
02:29
02:29OpenRouter@OpenRouterAI
OpenRouter 发布了全新 Discover 页面,帮助用户更直观地探索 AI 模型。该页面显示 Opus 5 在综合排名中占据整体领先地位,而 GPT 5.6 Sol 在编程任务上表现突出。同时,平台上路由器列表不断增长,为用户提供更多选择。
事件专题

推荐理由:OpenRouter 的新 Discover 页面让你一眼看清哪个模型最强——Opus 5 综合第一,GPT 5.6 Sol 编程厉害,还有更多路由器帮你挑。
7月25日
18:53
18:53官方账号Decoder@Matthias Bastian
Anthropic的Opus 5模型在Auto Mode下,针对浏览器智能体在129个测试场景中实现零提示注入成功率。无额外保护时成功率仅为3.7%。若实际表现一致,该模型可能解决了浏览器AI智能体最严重的安全问题。
事件专题

推荐理由:Anthropic的Opus 5在Auto Mode下把浏览器智能体的提示注入防御做到了100%,129个测试全过,这可能彻底解决智能体安全难题。
09:09
09:09官方账号Simon Willison’s Weblog博客/媒体
精选
Anthropic 的 Claude Opus 5 在提示注入(prompt injection)防护上取得显著进展。根据官方系统卡和红队评估,Opus 5 是 Anthropic 迄今最难以被成功提示注入的模型。这一结果基于多项 PI 评估和对抗测试,标志着大模型安全性的一次重要提升。
事件专题

推荐理由:Anthropic 的 Opus 5 在防提示注入上做到了史上最强,红队测试都很难攻破,安全团队值得关注。
08:13
08:13orange.ai@oran_ge
评价称Opus 5的智能水平略微超过降智后的Fable 5,且价格保持为Fable 5的一半。OpenAI的开源模型已超过旧版Opus 4.8。Opus 4系列在引领上半年后逐渐退场。评论认为在开源巨浪下,这些模型都将成为浪花。
事件专题

推荐理由:Opus 5干过了降智版的Fable 5,价格还便宜一半,开源模型也追上来了,值得关注这波模型更迭。