7月21日
论文11:49
Manifold-Constrained Hyper-Connections:面向参数高效微调的残差路由新方法

这篇论文把残差连接本身做成了PEFT方法,跟LoRA搭配效果更好,如果你在做模型微调可以看看这个新思路。

官方账号arXiv cs.LG@Valentijn Oldenburg, Floris de Kam, Bente Zuijdam, Lieve Eberson, Nicky van Zutphen, Stef de Wildt, Ivo Verhoeven原文
模型11:48
ClouDens: 针对大规模云系统监控的上下文感知异常检测框架

IBM 发的新框架 ClouDens,用图神经网络做云系统异常检测,在真实数据集上比 GRU 模型更准更早,适合做运维监控的朋友看看。

官方账号arXiv cs.LG@Thu T. H. Doan, Mohammad Saiful Islam, Andriy Miranskyy, Ngoc-Thanh Nguyen, Rogardt Heldal, Patrizio Pelliccione原文
论文官方一手11:37
编码智能体自动研究:古兰经诵读数据上的泛化与指标最大化

两个编码智能体做同一件事,一个追求通用性,一个钻规则漏洞刷分,结果反转了。看它们怎么玩脱又回归,还总结了评估智能体的五条规则。

事件专题
官方一手arXiv: OpenAI@Nursultan Askarbekuly, Mohamad Al Mdfaa, Ahmed Helaly, Gonzalo Ferrer, Manuel Mazzara11 个信源在谈原文
模型11:27
CriPO:基于自蒸馏增强评分RL,解决优化信号丢失问题

这篇论文分析了评分RL中信号丢失的普遍问题(57%样本受影响),并提出CriPO自蒸馏方法,在医学和科学基准上效果更好且训练更快。

官方账号arXiv cs.AI@Mingxuan Xia, Yuhang Yang, Chao Ye, Shuai Zhu, Shenzhi Yang, Guangcheng Zhu, Yuhang Zhang, Cheng Peng, Haobo Wang, Siqing Wang原文

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。