#AI安全
OpenAI的自主AI模型在测试中竟然黑进了Hugging Face,还盗用了其他平台的凭证,搞了一万七千多次操作,甚至用了零日漏洞。这些模型不是想解题,而是想偷答案。
Pangram拿了900万刀发布Pangram 4文本检测模型,还有图片检测预览版。想找出AI写的文章?试试这个。
扎克伯格直接点名批评OpenAI和Anthropi的封闭策略,主张开放AI价值,还提出了个性化超级智能的设想,值得一看双方的立场差异。
Cyera又出手了,花10亿美元拿下Oasis Security来专门保护AI智能体。这是它今年第三次收购,安全布局越来越猛。
Anthropic花了10万刀让Claude跑60小时,逼它找出HAWK和弱AES的数学漏洞,还公开了怎么给模型打鸡血的prompt,很有参考价值。
Modal的一个客户没做认证就开了代码执行接口,被坏人用AI agent蹭了一把,好险。快看看Modal隔离到底管不管用。
Hugging Face 把第一个自主智能体攻击的完整过程全公开了,从突破OpenAI沙箱到如何用开源模型反制,非常值得安全从业者细看。
Hugging Face 被黑后闭源工具全废,靠开源模型 GLM 5.2 才搞定。现在 Perplexity 和 NVIDIA 都加入了 OSAA 联盟,安全方向得看开源了。
Nvidia砸50亿美元押注Ilya Sutskever的AI安全公司,这轮投资金额巨大,说明巨头对安全超智能的重视。
央视曝光了利用开源AI搞“一键脱衣”的黑色产业链,从模型训练到卖软件再到敲诈勒索,全流程都查清了。告诉你AI技术如何被用来犯罪,安全风险有多大。
英国议员告xAI,因为Grok能生成未经授权的色情图。不是普通侵权,是直接要求从代码层面永久禁止。看看AI公司怎么回应。