全部动态
AI 相关资讯全量信息流 · 26999 条
9月2日
论文10:40
TempCloze评测视频大模型时间推理能力新基准测试揭示视频大模型在时间对齐上的短板,比语义理解更弱。
产品10:34
MiniMax H3 推出永不结束的 AI 直播 Infinite SlopMiniMax H3 做了个能根据观众聊天实时生成画面的 AI 直播,速度提升 50 倍,边播边生成还能保持故事连贯。
Facet-0:机器人基础模型实现高精度装配
官方账号arXiv cs.LG@Haoyuan Deng, Haichao Liu, Wenkai Guo, Yuan Ling, Zaijia Yang, Yuanjiang Xue, Haosheng Sun, Liangzi Wang, Ziwei Wang原文
Facet-0 模型通过预测和评估接触后果,让机器人能完成高精度装配,成功率比最强基线高出 5 倍多。
大模型SFT-RL标注预算分配研究
官方账号arXiv cs.LG@Jingtan Wang, Arun Verma, Xiaoqiang Lin, Zhengyuan Liu, Nancy F. Chen, Daniela Rus, Bryan Kian Hsiang Low原文
研究人员发现小模型实验就能确定可转移的近最优区域,无需大规模搜索,大幅降低大模型训练成本。
SAGE框架:从VLM教师学习自主策略
官方账号arXiv cs.LG@Matteo Merler, Giovanni Bonetta, Davide Zago, Rossella Cancelliere, Bernardo Magnini原文
SAGE框架让VLM只在关键时刻提供指导,大幅减少调用次数,学习到的策略甚至能超越VLM教师表现。
LLMs能否发现科学定律研究
官方账号arXiv cs.LG@Yiming Huang, Ziche Liu, Zhuohang Wu, Yiqian Wang, Junxia Cui, Xinkai Zou, Linjun Mao, Nan Huang, Naicheng Yu, Kaijie Zhu, Yue Ma, Kun Zhou, Letian Peng, Jingbo Shang原文
研究人员发布科学定律发现基准SCILAWS-BENCH,包含真实数据和合成世界两种测试场景,评估LLM科学发现能力。
扩散模型作为无时间步迭代推理训练课程
官方账号arXiv cs.LG@Mariia Drozdova, Aidan Sirbu, Pietro Miotti, Robert Obryk, Mayalen Etcheverry, Eyvind Niklasson, Blake Richards原文
新研究将扩散模型转化为迭代推理器,解决数独和迷宫问题表现优异,无需并行回滚或外部验证器。
PLES方法高效估计超参数缩放定律
官方账号arXiv cs.LG@Zhiliang Chen, Sebastian Ament, David Eriksson, Maximilian Balandat, Eytan Bakshy, Jihao Andreas Lin原文
PLES让大模型训练调参效率提升10倍,用小规模实验预测大规模最优配置。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档