5月31日
22:54
22:54Viking@vikingmute
DeepSWE 对 Opus 4.8 的评分显示,该模型在性能上优于 Opus 4.7,且成本更低、效率更高,但相比 GPT5.5 仍有明显差距。作者表示尚未深度使用 4.8,仍在使用更便宜的 4.6 版本,并指出对基准测试已逐渐祛魅,更看重推特上的真实用户评价。目前普遍认为 GPT5.5 仍是大多数用户的最强模型。
事件专题

推荐理由:如果你在纠结是否升级到 Opus 4.8,这篇推文帮你省了试错成本——作者用真实体验告诉你,4.8 性价比提升但远不及 GPT5.5,做模型选型的开发者建议看看推文下的真实讨论。
5月30日
16:04
16:04Gary Marcus@GaryMarcus
Anthropic 发布 Opus 4.8 模型后,开发者 Kaito 尝试用它重构整个代码库,耗时 2 小时、消耗 1 亿 token。尽管最终架构重置未能成功运行,但过程令人惊叹。这一事件展示了前沿 AI 模型在大型代码重构中的潜力与当前局限,引发社区对模型能力边界和成本效益的讨论。
事件专题

推荐理由:想用 AI 做大规模代码重构的开发者,看完这个真实案例会重新评估 token 预算和失败预期——1 亿 token 换来的教训比成功更有价值。
5月29日
21:35
21:35The Rundown AI@therundownai
今日 AI 头条:Anthropic 的 Opus 4.8 模型估值接近 1 万亿美元;Apple 新 AI Siri 将直接对标 ChatGPT;Codex 可用一条提示词构建游戏;AI 使开发者产出翻倍但并非人人受益;另有 4 款新 AI 工具及社区工作流发布。
事件专题

推荐理由:AI 行业格局正在重塑——Anthropic 估值逼近万亿、Apple 入局对话 AI,关注模型竞争和工具生态的开发者值得一看。
18:16
18:16Browser Use@browser_use
Browser Harness 推出新功能,支持 Claude Code 通过 Opus 4.8 模型直接操控浏览器。用户只需一条命令即可安装并开始自动化任何网站。该工具简化了浏览器自动化流程,降低了使用门槛,适合需要网页自动化的开发者和团队。
事件专题

推荐理由:做网页自动化的开发者终于有了更简单的方案——一条命令就能让 Claude Code 操控浏览器,建议试试看。
09:57
09:57官方一手歸藏(guizang.ai)@op7418
78°
Anthropic 发布了 Claude Opus 4.8,相比 Opus 4.7 在各项能力上均有提升。最关键的改进是模型自我审查能力显著增强,能够更有效地发现自身代码中的问题,而此前版本的自审几乎无效。新模型还拥有更敏锐的判断力、更诚实的自我评估,并能更长时间独立工作。Opus 4.8 定价与上一代相同,现已可用。
事件专题

推荐理由:对依赖 AI 编程的开发者来说,Opus 4.8 的自我纠错能力解决了代码审查的痛点——以前让模型自己 review 代码基本没用,现在可以真正信任它帮你发现 bug,建议立即升级体验。
08:24
08:24Augment Code@augmentcode
精选78°
Claude Opus 4.8 现已在 Cosmos 平台上线。该模型在长时间运行任务上表现优异,包括多小时的执行和从工单到 PR 的自动化工作流,几乎无需人工干预。相比 Opus 4.7,它拥有更敏锐的判断力、更诚实的自我评估能力,并能独立工作更长时间。价格保持不变。
事件专题

推荐理由:做自动化工作流和复杂工单处理的开发者,终于有了能跑通多小时的模型——Opus 4.8 在 ticket-to-PR 场景几乎零干预,建议直接上 Cosmos 试。
08:20
08:20Alex Albert@alexalbert__
精选
Anthropic 在 Opus 4.8 模型上投入了大量工作来校准其思考努力程度,旨在让模型在推理时既不过度思考也不思考不足。团队正在邀请用户测试并反馈模型在具体任务上的思考表现,特别是过度或不足思考的案例。这反映了 Anthropic 对模型推理质量精细调优的重视,有助于提升用户体验。用户可以通过回复或直接联系团队成员来提供反馈。
事件专题

推荐理由:Anthropic 正在主动校准 Opus 4.8 的思考深度,这对追求模型推理效率与质量平衡的开发者来说是个好消息——如果你在用 Claude 做复杂推理,反馈你的使用体验可以直接影响模型优化方向。
08:10
08:10Lenny Rachitsky@lennysan
Anthropic 发布 Claude Opus 4.8,这是 Opus 4.7 的升级版本。新模型在判断力上更敏锐,能更诚实地评估自身进展,并且比前代能独立工作更长时间。价格保持不变,即日起可用。这次更新聚焦于提升模型的自主性和可靠性,对需要长时间无人干预任务的用户尤其重要。
事件专题

推荐理由:Claude Opus 4.8 提升了自主工作能力和判断诚实度,做复杂长任务或自动化流程的团队可以直接升级,价格不变更值得一试。
08:08
08:08cat@_catwu
88°
Claude Code 团队发布了 Opus 4.8 模型,该模型在诚实性上有显著提升,能主动承认自己不知道的内容,并在代码中标记问题而非掩盖。Opus 4.8 被推荐为 Claude Code 日常使用的默认模型。这一更新旨在提升 AI 编程助手的可靠性和透明度,减少开发者的调试时间。
事件专题

推荐理由:Opus 4.8 解决了 AI 编程中常见的“幻觉”和掩盖问题,做代码审查和日常开发的团队可以直接在 Claude Code 中切换体验,减少不必要的排查成本。
02:45
02:45Alex Albert@alexalbert__
78°
Anthropic 发布了 Claude Opus 4.8,这是对 Opus 4.7 的改进版本。新版本在理解细微差别、对话自然度以及协作能力上均有提升,尤其在编程和知识工作方面表现更佳。Opus 4.8 还引入了更诚实的自我评估机制,能够更独立地长时间工作,且价格保持不变。
事件专题

推荐理由:Claude Opus 4.8 解决了用户对 4.7 的反馈痛点,提升了对话自然度和协作效率,做编程或知识工作的团队可以直接升级体验,值得一试。
02:12
02:12OpenRouter@OpenRouterAI
83°
OpenRouter 宣布 Opus 4.8 模型正式上线,价格与 4.7 版本相同,但在智能体编程、推理和计算机使用方面有显著提升。相比 4.7,代码缺陷遗漏率降低约 4 倍。同时推出 Opus 4.8 Fast Mode,成本仅为 2 倍,速度提升 2.5 倍。该更新对依赖 AI 编程和推理的开发者是直接利好。
事件专题

推荐理由:Opus 4.8 在不涨价的前提下大幅提升了编程和推理能力,做智能体开发或代码审查的团队可以直接在 OpenRouter 上体验,性价比很高。