这篇论文用物理中的三体散射思路做生成模型,仅需一步就达到 DiT-XL 的 FID 1.63,比传统扩散模型少很多步。
部署多模态模型时延迟高吞吐低?FlashRT 让智能体自动优化,实测延时降 70 倍,吞吐升 3.6 倍,AMD 平台效果尤其猛。
这篇论文解决了数字孪生中模型漂移的老大难问题,用LoRA和统计检验做到实时更新,增材制造案例表现很好。
这篇论文系统测了GPT等LLM在3D分子生成上的表现,发现它们虽不如专用扩散模型,但能同时处理多种约束,值得关注。
这篇论文把残差连接本身做成了PEFT方法,跟LoRA搭配效果更好,如果你在做模型微调可以看看这个新思路。
IBM 发的新框架 ClouDens,用图神经网络做云系统异常检测,在真实数据集上比 GRU 模型更准更早,适合做运维监控的朋友看看。
这篇论文解释了为什么Megatron-Core的MLA吸收模式在训练时会导致内存暴增,还给出了一个叫LAGA的修复方法,通信更省,速度和内存几乎没损失。
这篇论文用五类模型分析了LLM为何容易被提示带偏,发现全是微调惹的祸,每个偏差还有独立方向,能直接修正。
两个编码智能体做同一件事,一个追求通用性,一个钻规则漏洞刷分,结果反转了。看它们怎么玩脱又回归,还总结了评估智能体的五条规则。
这篇论文教你如何让大模型不再自己绕圈圈,用激活引导精准干预推理过程,实测有效提升准确率。
如果你想看语言模型在世界杯预测上的硬核评测,这个基准用104场真实比赛对比了13个系统,结果比博彩市场强得有限,但细节预测有亮点。
这篇论文分析了评分RL中信号丢失的普遍问题(57%样本受影响),并提出CriPO自蒸馏方法,在医学和科学基准上效果更好且训练更快。
这篇论文提出了一种在手机上跑大模型的新思路:不加载全部神经元,只算有用的部分。效果不错,内存和计算都省很多,关键是精度没掉。
这篇论文提出了SIEVE,用智能体主动找几处关键证据就能判断视频真假,不用看完整个视频,效果更好还更透明。
一篇关于多模态机器人模仿学习的论文,提出LAG-Fusion解决不同传感器速率不同的异步融合问题,实验证明比同步融合更高效。
这篇论文对Hugging Face上近十万个模型的文档完整性做了大规模分析,发现很多模型缺少许可证、局限性和环境信息,对想了解开源模型供应链透明度的朋友很有参考。
这篇论文用QQ等式定量审计LLM的顺序效应,还给出了理论机制和实用流水线,适合对模型行为一致性感兴趣的人读。
这篇论文系统测试了用SWE-trajectory数据微调Qwen2.5-Coder时,不同轨迹筛选方法的效果,发现数据质量和数量在不同规模下影响不同,值得参考。
仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。