全部动态

AI 相关资讯全量信息流 · 170 条
7月27日
7月24日
7月23日
论文多源确认11:52
ChannelGuard:安全模型组合未必安全,多智能体系统防御框架

这是篇讲多智能体LLM安全漏洞的论文,提出ChannelGuard,不额外调用LLM,在Agent间加门控,能防住工具投毒和指令注入,而且实验用了三个不同模型后端,结果很实在。

事件专题
arXiv: Anthropic@Elias Hossain 等 5 人10 个信源在谈原文
7月22日
7月21日
7月17日
论文精选17:48
AI协助解决统计学开放问题:GPT-5.6证明BH过程无法控制FDR

AI真的在推动数学进步了:GPT-5.6只用90分钟就找到了统计学里一个经典开放问题的反例,而5.5版本折腾20小时都没搞定。这篇报告值得所有关心AI科研能力的人看。

事件专题
Marc Andreessen@pmarca2 个信源在谈原文
7月16日
7月15日
7月14日
论文多源确认09:10
Claude Fable 5在生物医学挑战问题上的能力评估

这篇论文很有意思,告诉你Claude Fable 5在医学难题上不是不会答,而是经常拒绝回答。一旦它愿意回答,准确率反而是最高的。如果你想了解模型的安全边界和真实能力,值得看看。

事件专题
arXiv: Anthropic@Dominic Okonkwo 等 4 人11 个信源在谈原文
7月13日
7月9日
7月7日
7月6日
7月3日
7月2日
7月1日
6月30日
6月29日
6月25日
6月24日
6月19日
6月18日
6月17日