论文Agent 与开发者多源确认精选73°10:32SRD-GUARD:通过语义改写和多模型评分防御LLMSRD-GUARD能更好识别伪装攻击,在Llama-3和DeepSeek模型上表现优异,比现有防御方法有更好的DSR-ORR权衡。#SRD-GUARD#Llama-3-8B-Uncensored#DeepSeek-V4-Flash#AI安全2 个信源在谈事件专题aarXiv: DeepSeek@Qi Wang 等 3 人3 个信源在谈原文稍后读已读值得跟进有用关注 SRD-GUARD