这篇论文揭示了负移位梯度下降的谱正则化机制,能突破负脊端点的结构限制,在过参数化线性回归中实现更优的混合符号滤波。
这篇论文告诉你,艺术家也能像玩材料一样玩扩散模型内部。他们在ComfyUI做了交互工具,能直接操纵Stable Diffusion的层,看到具体变化。不是理论说教,是真能动手调的。
研究了一套专门针对 NFT 合约的漏洞检测方法,用 DeepSeek 加代码切片把准确率干到了 97.1%,比纯分析完整合约高了 23 个百分点。做合约安全的可以看看。
这篇论文教你如何通过修改网页内容让大模型推荐时把你想要的东西排第一。SIREN用PAIR越狱循环,在Claude模型上成功率80%,挺有意思的。
这篇论文把Hyperball优化器的机制拆开来看,发现它并不像传说中那样自动解决学习率调度问题,掌握好调度才是关键。
北大和华师大团队用AlphaFold3做了个ContactSeek,能精准设计基因编辑工具,论文登了Nature,基因治疗领域可关注。
这篇新论文把智能体常栽跟头的上下文问题拆成五个可操作的原语,还给出了验证方案,在LongMemEval和LoCoMo上分别跑了92%和93.2%。
这篇论文搞了个VLM-IE3D,让普通视觉语言模型看RGB视频就能学会3D空间感,不用额外3D设备,而且好几个3D任务都做得更好。
时间序列分类的黑盒解释往往只找够用的特征,但可能抓到噪音。这篇论文提出了TimePNS,用反事实推理揪出真正必要的子序列,实验效果比现有方法好。
想知道 AI 定理证明在量子计算领域到底多强?这篇论文给了两个新基准和四个模型实测分数,LAD 方法能提升最高 15.9 分,很实在。
这篇论文解决了长上下文下投机解码的瓶颈,用滑动窗口草稿省掉99%的KV读取,实测速度提升近三成,而且不损失精度。搞大模型推理优化的值得看。
这篇论文给出了高召回场景下审计遗漏量的理论基础和实用方法,适合做检索系统或数据管线的朋友参考。
这篇论文发了KroQuant,用Kronecker结构做激活变换,W4A4量化又快又准,比SVDQuant和LoRaQ结果好,还省参数。
这篇论文提出了VCSD,不需要外部老师就能让多模态模型自己教自己,在Qwen3-VL上几个规模都涨了4-5个点,而且不增加推理成本。
这篇论文用Petri网编排LLM,自动生成并发Rust API的测试用例,比纯LLM生成的更可靠,能挖到深层并发bug。
这篇论文把AI代理失效的真正原因讲透了——不是推理不行,而是管不住上下文。还给了个参考实现,LongMemEval和LoCoMo成绩都90%以上。
这篇论文揭示了LLM中一种不易察觉的修辞滥用,并给出了具体测量和缓解方法,适合关注模型文本风格和RLHF影响的读者。
AREX这篇论文让AI自己递归改进答案,在多个搜索和推理基准上超越了同体量模型,想了解自我优化怎么做可以看看。
这篇论文用智能体自动发现概念,让REIMS数据的手术切缘评估更可解释、更准确,真实术中场景也表现更好。
一篇新论文提出了MAPS架构,用层次化强化学习解决无信号交叉口的多车协调问题,在72种场景下实现无碰撞且更快通行,还能零样本从3车迁移到5车,效果很扎实。
想知道开源模型做数据清洗行不行?这篇论文用真实研究数据测试了31-35B模型,近九成任务都能搞定,隐私保护场景也能用。
仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。