论文
arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5284 篇
9月17日
一种针对混合专家语言模型的专家剪枝方法 HOPE
研究团队提出的新方法 HOPE,通过考虑专家间的协同作用来优化混合专家语言模型的剪枝过程,在 122B 参数模型上测试,HOPE 在 50% 剪枝率下比 REAP 等方法性能更好,在代理任务上提升达 6.1%,证明了其有效性。
稀疏特征揭示视觉语言模型在有害表情包检测中的读出瓶颈
这个研究挺有意思的,用稀疏特征的方法分析了Gemini和Qwen在检测有害表情包时的表现,发现模型内部其实有相关证据,但读出机制出了问题,这个发现挺有深度的。
Stability-Guaranteed Arbitration of Autonomous AI Agents in O-RAN
这个研究很实用,解决了O-RAN系统中AI代理独立运行时可能出现的资源冲突问题,推荐给对通信和AI结合感兴趣的朋友。
研究揭示开源大模型在招聘中存在性别和种族偏见触发机制
朋友,这篇论文挺有意思的,它不是简单说大模型有偏见,而是具体分析了哪些语言触发器(比如代理性语言、排斥性编码)会导致偏见,还给出了一个具体的审计方法,对做招聘AI系统的人应该挺有参考价值。
DeepSeek 的 CoAtNet-DeepMoE 模型提升番茄病害分类准确率
DeepSeek 新出的 CoAtNet-DeepMoE 模型,用混合专家技术把参数量从几百万降到两百万左右,同时保持高准确率,对做农业病害识别的应该有用。
OpenAI 2026 强迫 Navier-Stokes 方程有限时间爆破构造中 GD1998 精确解的相似变量重访
朋友,OpenAI 新发布的 2026 强迫 Navier-Stokes 方程有限时间爆破构造挺有意思,这篇论文专门研究了它和 1998 年 GD1998 精确解的关系,挺硬核的。