全部动态

AI 相关资讯全量信息流 · 161 条
7月27日
7月24日
7月23日
论文多源确认11:52
ChannelGuard:安全模型组合未必安全,多智能体系统防御框架

这是篇讲多智能体LLM安全漏洞的论文,提出ChannelGuard,不额外调用LLM,在Agent间加门控,能防住工具投毒和指令注入,而且实验用了三个不同模型后端,结果很实在。

事件专题
arXiv: Anthropic@Elias Hossain 等 5 人10 个信源在谈原文
7月22日
7月21日
7月20日
7月17日
7月16日
7月15日
7月14日
论文多源确认09:10
Claude Fable 5在生物医学挑战问题上的能力评估

这篇论文很有意思,告诉你Claude Fable 5在医学难题上不是不会答,而是经常拒绝回答。一旦它愿意回答,准确率反而是最高的。如果你想了解模型的安全边界和真实能力,值得看看。

事件专题
arXiv: Anthropic@Dominic Okonkwo 等 4 人11 个信源在谈原文
7月13日
7月9日
7月8日
7月7日
7月3日
7月2日
7月1日
6月30日
6月25日
6月24日
6月23日
6月19日
6月18日
6月17日
6月16日
论文多源确认10:05
Agentic AI生成并行Julia代码的可扩展性研究

这篇论文测试了GPT-5.5、Claude Opus 4.7和Qwen3-Coder-Next用智能体写并行Julia代码,在超算上跑192核,发现小规模还行,大规模容易死锁或OOM,开源模型最差。做HPC或Julia并行开发的人值得看。

事件专题
arXiv: Anthropic@Linus Bantel 等 4 人11 个信源在谈原文