12:04官方一手arXiv: DeepSeek@Haifeng Wu, Srinivasan Manoharan, Fangbo Tu, Junhua Zhao, Jian Wan精选RLM-Cascade是一个代理层投机解码系统,在响应级别优化LLM API调用。它使用DeepSeek作为草稿模型、Opus作为验证模型,并通过轻量复杂度路由器选择路径。在Claude Code生产环境中,系统达到88.8%的草稿使用率,API成本相比直接使用Opus降低45.8%。P50延迟从3698毫秒降至2026毫秒,实现1.83倍加速。在20个Code/Math/Instruct任务基准上,RLM-Cascade通过率达100%,高于Opus的95%。AI模型RLM-CascadeDeepSeekOpus推荐理由:这个系统把DeepSeek和Opus组合起来,用投机解码省了近一半API成本,还快了一倍,质量也有提升,而且开源可部署。原文稍后读已读值得跟进有用关注 RLM-Cascade
14:19IT之家(博客/媒体)73°Anthropic 于 5 月 13 日宣布,Claude Agent SDK(包括通过第三方应用及 'claude -p' 调用)的计费方式将从标准订阅调整为按 API Token 用量计费,原定 6 月 15 日生效。开发者 Matthew Diakonov 分析,若以 Opus 模型作为主编码助手,第一周就会超过盈亏平衡点。代码编辑器 Zed 团队也警告用户这是一次“重大成本增加”。Anthropic 于 6 月 15 日更新支持页面,宣布暂停该变更,并表示目前没有任何变化。行业AnthropicClaude Agent SDKOpus10 个信源在谈事件专题推荐理由:Anthropic 听取了开发者意见,暂停了 Claude Agent SDK 的 Token 计费变更,避免了成本飙升。如果你在用这个 SDK,现在可以松口气了。原文稍后读已读值得跟进有用关注 Anthropic
13:35宝玉@dotey宝玉(@dotey)介绍了其日常整理AI资讯的Skill「info-digest」,该Skill基于Claude网页版+Opus 4.6生成初稿,再人工校验微调后发布到X和微博。提示词设计要点包括:从读者关心角度写作、联网检索做事实核查、交代背景信息、生成格式适配平台(纯文本、短小精炼)。完整Skill提示词开源于GitHub仓库JimLiu/Illustrated-Agent-Skill。技巧ClaudeOpusGitHub推荐理由:宝玉分享了他写AI资讯的Skill,提示词设计思路很实用——怎么让AI生成读者想看的内容、怎么联网查证避坑。原文稍后读已读值得跟进有用关注 Claude
13:20AI Will@FinanceYF5Dan McAteer 分享了一种在 Claude Code 中高效使用 Claude Fable 的方法:将模型设置为 Fable 5,推理模式设为 Max,并让 Fable 作为编排者,Opus 负责推理重任务。这样能避免频繁触发使用限制,同时发挥各模型优势。该方法适用于需要复杂推理和长流程的自动化场景,能显著提升效率。技巧Claude CodeFableOpus推荐理由:做复杂自动化流程的开发者,用这个方法能避开 Fable 的限额瓶颈,让 Fable 当调度、Opus 干重活,效率翻倍,值得一试。原文稍后读已读值得跟进有用关注 Claude Code
02:47AI Engineer@aiDotEngineer精选Codex Spark生成代码速度达1200 tokens/秒,而Sonnet和Opus仅40-60 tokens/秒,快了约20倍。Cerebras的@MilksandMatcha指出,若开发者习惯不佳,更快速度只会导致更快生产坏代码。他提供了实用指南视频,帮助适应高速生成。技巧Codex SparkSonnetOpus推荐理由:Cerebras教你避免快速写坏代码原文稍后读已读值得跟进有用关注 Codex Spark
17:42AI Will@FinanceYF5Anthropic 内部工程负责人已几乎不再亲自写代码,而是依赖其模型 Opus 完成主要编码工作,自己仅负责编辑和审查。这表明 AI 编程能力已接近替代初级工程师的日常任务。虽然目前软件工程师仍有价值,但随着模型能力持续提升,这种角色转变可能加速。该趋势对开发者职业规划和技术团队分工有深远影响。行业AnthropicOpusAI 编程5 个信源在谈事件专题推荐理由:AI 编程正在从辅助工具变成主力,做软件开发的团队和个人需要重新思考自己的角色定位——是继续写代码还是转向编辑和架构设计,建议点开看看这个真实案例。原文稍后读已读值得跟进有用关注 Anthropic
01:41berryxia@berryxiaSlides Arena 发布了基于 370 万+ 真实创作者使用场景的 Agentic Slides 排行榜,Anthropic 的 Opus 4.7 包揽前两名,智谱的 GLM 5.1 位列第三。该排行榜基于真实世界的幻灯片生成场景,强调逻辑、创意和设计感,而非实验室 benchmark。结果显示 Claude 在 Agentic 设计领域仍具领先优势,但 GLM 表现亮眼。AI产品GLMOpusAgentic Slides10 个信源在谈事件专题推荐理由:做 PPT 设计或 Agentic 内容生成的团队,这份基于 370 万真实场景的排行榜值得参考——GLM 5.2 能紧追 Opus 4.7,说明国产模型在创意密集型任务上已有竞争力,建议点开看看完整榜单。原文稍后读已读值得跟进有用关注 GLM