7月8日
03:33
7月7日
11:24
06:32
06:32官方一手Anthropic: Newsroom资讯
阿尔伯塔省政府利用Claude(Anthropic的AI模型)对政府系统进行网络安全漏洞扫描。Claude的代码分析和漏洞识别能力帮助安全团队发现了多个关键漏洞。这些漏洞已被修复,有效降低了系统被攻击的风险。
事件专题

推荐理由:Anthropic分享了一个真实案例:阿尔伯塔省政府用Claude找漏洞,比传统人工扫描更高效,搞安全的值得看看。
03:42
03:42官方账号Anthropic@AnthropicAI
精选
Anthropic在论文中引入J-space,一种能够读取、审计和塑造Claude内部思考过程的方法。该方法可提高模型的可信度和透明度,尤其适用于能力不断增强的AI系统。研究还发现了语言模型与人类思维之间令人惊讶的相似性。论文全文发布于transformer-circuits.pub/2026/workspace。
事件专题

推荐理由:Anthropic这次直接打开了Claude的思维黑箱,能用J-space看它在想什么,还能干预调整,对AI安全来说是个新思路。
7月6日
18:15
18:15官方账号Decoder@Maximilian Schreiner
71°
安全公司Sysdig发现名为JADEPUFFER的勒索攻击,其语言模型自主完成入侵、窃取凭证并销毁数据库,全程无人类操控。该攻击利用旧有安全漏洞,以机器速度执行传统需人工步骤的流程。Sysdig指出这是首次观察到完全由AI代理驱动的勒索软件操作。
事件专题

推荐理由:Sysdig发现首个完全由AI自主操作的勒索攻击JADEPUFFER,能自己偷凭证删数据库,安全漏洞被加速利用。
7月5日
08:03
08:03IT之家博客/媒体
路透社援引知情人士称,特朗普政府与Anthropic从未商议过政府入股该公司。此前OpenAI被曝探讨向美国政府出让5%股份。美国商务部6月撤销了对Anthropic两款大模型的出口管制,理由曾是对安全防护不足的担忧。参议员桑德斯提案要求大型AI企业向政府出让50%股权并派驻董事。
事件专题

推荐理由:告诉你,别瞎猜了:Anthropic和特朗普政府根本没谈过入股的事,但OpenAI那边却在讨论出让5%股份给政府。这新闻把两家公司的最新情况说清楚了。
7月4日
01:30
01:03
01:03官方账号Decoder@Matthias Bastian
Epoch AI数据显示,2026年6月21家组织提交了约1500个高严重性和关键性CVE漏洞报告。这一数量是此前月度纪录的3.5倍以上。报告激增与AI驱动的漏洞狩猎工具上线时间吻合。AI模型主动搜索漏洞显著提升了发现效率。
事件专题

推荐理由:Epoch AI用数据说话:AI漏洞狩猎让每月漏洞发现量飙到1500个,比之前纪录高3倍多,效率惊人。
7月3日
19:27
15:07
11:57
11:57官方账号arXiv cs.LG@Thomas Winninger
论文提出RFM-AGOP方法,通过适应RFM算法和探针初始化,在数秒内从推理模型Qwen 3和非推理模型Qwen 2.5中提取多维拒绝子空间。该方法在消融任务上表现优于现有方法,且计算成本较低。研究为LLM安全对齐提供了高效可扩展的监控手段。
推荐理由:想低成本搞懂LLM拒绝行为?这篇论文用RFM-AGOP几秒就定位到多维子空间,比传统方法快还准。