论文把机器遗忘做到属性级:让模型忘掉指定属性,但保留同一人的其他信息。CLRP不用重训练,在多种多模态模型上都有效。
#AI安全
1321 条 · 查看话题观测
8月4日
论文09:20
面向细粒度遗忘:多模态大语言模型的属性级遗忘20VC 对话 ML Angelopoulos:Kimi K3 与开源模型安全
LMSYS CEO 在 20VC 直接开讲:Kimi K3 已经超越西方闭源模型,还警告开源权重可能藏后门。想听不绕弯的行业实话,可以看这个。
8月3日
行业14:16
IBM调查:1/4恶意数据泄露由AI攻击造成,平均损失高于均值20%IBM这份报告给出关键数字:AI攻击占恶意泄露四分之一,单起平均损失600万美元,比整体高20%。搞安全的可以对照下自己的防线。
IT之家原文
AI安全人才短缺:METR年薪50万美元仍招不到人
Beth Barnes创办的METR专门独立评估OpenAI、Anthropic等前沿模型,年薪开到50万美元还在喊缺人,还提前抓到了GPT-5.6作弊,值得看看。
论文09:16
QR-STT:红外视觉语言模型的隐秘热触发攻击红外视觉模型能被QR码图案定向误导?论文提出QR-STT,黑盒无需训练,改分类还影响问答,AI安全党可以看看。
8月2日
8月1日
产品17:05
Google Earth上线Nano Banana 2,两天后因假卫星图像撤下Google把Nano Banana 2塞进Google Earth,结果有人用它生成了假卫星照片,两天就被下线了。看看怎么做到的。
行业07:08
Gary Marcus:Constitutional AI并未奏效,LLM无法遵循硬约束Gary Marcus说Constitutional AI不靠谱,LLM守不住硬约束,得找替代方案。
Oxide播客:开放权重革命与Simon Willison
这期播客聊了Kimi K3和DeepSeek V4 Flash,还有Anthropic翻车的事,听听Simon怎么评价开放权重和闭源模型的差距。
Truffle Security扫描HuggingFace训练数据,发现22万条有效凭证
他们扫了HuggingFace上7.6PB的训练数据,挖出22万个还活着的密钥,折合每年92万美元的损失。搞AI训练的人得看看自己的数据里有没有漏钥匙。
7月31日