#AI安全

1318 条 · 查看话题观测
7月24日
7月23日
论文官方一手11:52
ChannelGuard:安全模型组合未必安全,多智能体系统防御框架

这是篇讲多智能体LLM安全漏洞的论文,提出ChannelGuard,不额外调用LLM,在Agent间加门控,能防住工具投毒和指令注入,而且实验用了三个不同模型后端,结果很实在。

事件专题
官方一手arXiv: Anthropic@Elias Hossain, Md Mehedi Hasan Nipu, Fatema Tuj Johora Faria, Tasfia Nuzhat Ornee, Maleeha Sheikh10 个信源在谈原文
7月22日