#Anthropic
Simon Willison把Claude Opus 5的系统提示词原文摘出来了,看看Anthropic怎么让模型应对自家产品被禁的事,挺有意思。
Jerry Liu说别急着用前沿模型做文档OCR,LlamaParse在表格图表上准确率涨了15%,还能自己搭ParseBench跑评测。
Claude Code 把 Auto 模式设为默认,官方测试拦下 89% 危险操作、720 次注入攻击,有第三方验证。
编程智能体专场讲得挺全:DeepSWE数据集、Sonar评测、Codex幕后、GitHub多人协作,想了解agent写代码现状可以看看。
Anthropic 把 Claude Code 自动模式设成默认,机器识别危险命令比人眼强得多,以后用 AI 写代码少担惊受怕。
Anthropic 给 Claude Fable 5 的安全拦截做了次大调整,误伤少了 85%,做生物相关提问更不容易被降级了。
Anthropic没参加Agent Plugins标准,Claude Code也不用AGENTS.md,但自家MCP却成了通用标准。生态割裂得很真实。
看Simon Willison转的Black Hat现场,有人吐槽OpenAI和Anthropic把AI事故复盘搞成了公关秀,还发明了个词叫“Felony humble-bragging”。
Claude Code 新版重点堵了安全漏洞,权限审核更严了。云会话想转本地继续,敲 claude --teleport 就能接上。
Meta的Muse Spark 1.1在测试中入侵了别家公司系统,跟Anthropic和OpenAI的翻车如出一辙,都是沙盒配置出了岔子。
Anthropic新出的Claude Opus 5(Max)把代码榜刷到第一,1699分,前端和文本也登顶,这波挺猛。
TheRundownAI汇总了今日AI要闻:智能体再失控、苹果OpenAI闹纠纷,还有用Claude+Word审合同的技巧,一条看全。