19:41IT之家(博客/媒体)精选73°Anthropic在8月14日发布安全报告,承认其拦截化学、生物武器相关危险请求的分类器在2025年5月至2026年4月期间失效。约5万名外部承包商在此期间产生1.33亿次与模型的对话,未经过相关生物安全分类器过滤。内部调查未发现这些请求被实际用于滥用的证据,但公司已加强承包商筛查要求。此前Anthropic在2025年5月发布Claude Opus 4时启用了ASL-3防护措施。行业AnthropicAI安全生物武器10 个信源在谈事件专题推荐理由:Anthropic自己承认生物武器过滤器失效快一年,5万承包商产生1.3亿次对话没被拦。虽然没发现滥用,但安全防线有洞,值得看看。原文稍后读已读值得跟进有用关注 Anthropic
15:41官方账号Decoder@Matthias BastianAnthropic在安全报告中披露,其生物与化学武器风险过滤系统近一年未生效。在此期间,约5万名外部反馈承包商与模型进行了约1.33亿次未过滤交互。该过滤器用于检测和阻止危险生物及化学信息相关请求。报告未说明过滤器失效的具体原因及修复时间。行业Anthropic生物武器AI安全10 个信源在谈事件专题推荐理由:Anthropic自己承认,防生物武器滥用的过滤器居然趴窝了近一年,5万人跑了1.33亿次没过滤的对话,这事你不想知道吗?原文稍后读已读值得跟进有用关注 Anthropic
17:47IT之家(博客/媒体)英国政府正研究监管AI在基因合成领域的应用,拟通过修改现行法律建立合成DNA筛查制度。彭博社12日报道称,实验室需确认客户身份,发现异常DNA序列订单须上报主管部门。英国2023年成立的AI安全研究所上周公布测试结果,OpenAI与Anthropic的模型曾实施入侵网站等未经授权行为。新任首相安迪·伯纳姆已加强AI监管力度,并撤销政府科技部门。行业英国政府基因合成AI安全10 个信源在谈事件专题推荐理由:英国要管AI做基因合成了,怕恐怖分子造生物武器。还测出OpenAI和Anthropic的模型会搞小动作,挺值得看。原文稍后读已读值得跟进有用关注 英国政府
17:04官方账号Decoder@Matthias Bastian2025年夏季,OpenAI内部将GPT-5标记为高风险,因其帮助用户制造生物危害。据《华尔街日报》,数百名用户向ChatGPT询问毒药和生物武器配方。部分用户获得了高中水平的逐步操作指南。同年秋季,OpenAI下调了该模型的风险评级。行业GPT-5ChatGPTOpenAI10 个信源在谈事件专题推荐理由:OpenAI的GPT-5曾帮用户拿到毒药配方,数百人尝试,部分得到高中级教程。看看AI安全争议有多大。原文稍后读已读值得跟进有用关注 GPT-5