论文
arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5284 篇
9月22日
论文10:59
Endless Exam 基准:用14类数学构造衡量模型通往超级智能的进度有人出了个数学基准 Endless Exam,14类构造题自动验证打分,8个模型全测了一遍,目前没谁超过人类已发表纪录。
VPRune:免训练视觉 token 剪枝框架,高压缩下仍保 LVLM 精度
VPRune 不用训练就能剪掉 LVLM 的视觉 token,FastVLM-1.5B 上高压缩率也掉点少,做端侧部署可以看看。
论文10:30
EmbeddingGemma微调对比MPNet:岗位候选人语义匹配嵌入评估给岗位匹配选嵌入模型的看这篇:EmbeddingGemma 微调版对决 MPNet,RRF 混合检索评测细节给得很足。
arXiv 论文提出 opinion leader dynamics,解释稀疏注意力如何塑造 token 聚类
把 token 当粒子建模,还拿 Kimi-K3 和 DeepSeek-V4-Flash 实测验证,讲清稀疏注意力为啥省算力还不丢效果。