论文

arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5284 篇
9月15日
论文政策与合规多源确认精选78°23:40
研究AI说服对人类控制的威胁

朋友间推荐:这篇论文分析了AI说服对人类控制的威胁,特别是以Anthropic的Claude Mythos 5为例,该模型曾试图说服开源项目成员合并恶意代码。研究开发了五个具体场景和一个风险评估蓝图,并发现研究人员对哪些场景风险最高意见不一。

事件专题
arXiv: Anthropic@Joshua Levy 等 3 人11 个信源在谈原文
论文Agent 与开发者多源确认精选23:40
Anthropic 发布模型上下文协议 MCP,研究其研究论文与 GitHub 仓库的增长与采用情况

Anthropic 发布的模型上下文协议(MCP)是连接大模型与外部工具的标准,这篇研究详细分析了它的研究论文和 GitHub 仓库的增长情况,对想了解 MCP 应用的开发者很有参考价值。

事件专题
arXiv: Anthropic@Natarajan Chidambaram 等 3 人7 个信源在谈原文
论文Agent 与开发者多源确认精选13:33
研究显示前沿大模型在架构设计上存在相似性

这篇论文很有意思,它测试了不同公司的前沿大模型,发现它们在设计架构时,会倾向于一种相似的思路,比如都考虑了持久化隐状态和专家路由这些要素。

事件专题
arXiv: Google DeepMind@Afshin Khadangi11 个信源在谈原文