论文
arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 2100 篇
9月23日
CliffCompaction:让长程编程智能体的上下文压缩成本降低最多 50%
这篇讲了怎么把智能体跑长任务的 token 开销砍一半,方法只有一条:压缩只删不改,还开源了能在 Claude Code 里直接用的实现。
论文10:16
论文提出 LYRA 方法破解长上下文检索中的 Proximity Trap一篇很实在的论文:作者发现长文档检索差的真正元凶是近处无关文字抢注意力,给出 LYRA 方法外加 ProxBench 基准,做了 RAG 的话值得看他们的实验数据。
OPD 蒸馏方法让低比特量化模型恢复推理能力
量化到 2-bit 后模型做数学题会发疯循环?这篇论文用 on-policy 蒸馏把 MATH-500 保留率从 35% 拉到 70%,做端侧部署的可以看看。
Optimal Sequential Annotations for Off-Policy Evaluation:有限标注预算下的双稳健估计方法
标注预算不够又想评估策略?这篇 arXiv 论文告诉你怎么分配人工标注最省钱,RMSE 能降一半以上。
谱理论解释 grokking 现象:weight decay 驱动特征学习
研究 grokking 为什么突然泛化的论文,理论算出 grokking 时间由学习率乘 weight decay 决定,还用上千个网络验证了,做可解释性的可以看看。
论文10:11
LOKI:用文本证据发现异构数据表间关联的新方法数据集成领域的新论文,LOKI 能自动从文本里发现不同表之间的行级关联,精度 0.982,比直接调 LLM 便宜 40 倍,做数据湖的可以看看。
研究发现 LLM 推理输出随数值精度变化:BF16 与 FP16 会产生不同结果
一篇挺有意思的论文:同样的模型和提示,BF16 和 FP16 居然输出不一样,作者还给出了低于 4% 延迟开销的修复方法。
9月22日
论文12:55
NGRC 从单一观测推断混沌系统未知分量,验证扩展至 ENSO 气候数据NGRC 用更少数据就能从 Lorenz 系统一个变量推出另外两个,比传统 RC 省时省算力,还在真实 ENSO 气候数据上跑通了
onPanda:token 级纠正标注对齐数据,中位标注时间省 52%
标注对齐数据不用整段重写,定位到第一个错 token 改掉让模型接着生成,实验里中位时间省 52%,还附了 Panda-CVL 数据集。
论文10:13
TLS方法用于托卡马克破裂预警:在DIII-D和EAST上优于DSM托卡马克最怕等离子体突然破裂,这篇论文把生存模型改成只看有限时间窗,TLS 在 DIII-D 和 EAST 上报警最准。