全部动态

AI 相关资讯全量信息流 · 5054 条
7月28日
论文精选11:43
深度学习陀螺仪偏差校正的不确定性与可解释性研究

这篇论文教你如何用深度学习分解陀螺仪偏差校正的不确定性,还用了梯度归因来分析模型行为,适合做状态估计或故障检测的人参考。

官方账号arXiv cs.LG@Mariela De Lucas Álvarez, Melvin Laux, Arthur de Freitas Precht, Maurice Martin, Edoardo Caroselli, Frank Kirchner, Alexander Fabisch原文
论文11:02
E-Bench:多步工具使用智能体的真实产品基准

想知道多步工具调用到底多难?E-Bench测了11个模型,最强不到60%通过率,还特意选了王者荣耀、QQ音乐和腾讯会议场景。

事件专题
官方账号arXiv cs.AI@Weihuang Zheng, Tianyuan Zou, Eileen Ye, Alphet Liu, Youyong Kong, Ya-Qin Zhang, Duran Zheng, Maxm Pan2 个信源在谈原文
论文11:00
O^2-CritiCuRL:离线-在线课程强化学习提升多模态推理

这篇论文提出了一种新方法,能解决多模态模型推理时中间步骤乱但结果对的问题,效果SOTA还更高效,做推理增强的可以看看。

官方账号arXiv cs.AI@Wendi Deng, Hang Du, Guoshun Nan, Haokun Tian, Jiaqi Yu, Xinlei Cao, Jaile Li, Jingfeng Chen, Ling Deng, Ting Li, Hao Yang, Jun Liu, Xudong Jiang, Sicong Leng原文
论文10:35
HyGAE:VLM智能体强化学习的混合优势估计与统一评价器

这篇论文提出了HyGAE方法,让VLM智能体在多个回合的决策任务里表现更好,平均成功率91%,比别的方法高了10%,值得搞强化学习和多模态的研究者看看。

官方账号arXiv cs.AI@Wenxuan Zhang, Yuhui Wang, Donggang Jia, Xiaoqian Shen, Jian Ding, Ivan Viola, Jürgen Schmidhuber, Mohamed Elhoseiny原文
论文官方一手10:06
生成式AI证据的半衰期:40条记录审计、声明货币性框架及前沿模型辅助研究

这篇论文研究了AI模型评估结论过时的速度,发现模型发布后近一年结论可能已失效。如果你做AI评测或读评测报告,它能帮你判断证据是否还新鲜。

事件专题
官方一手arXiv: OpenAI@Carlo Iacono2 个信源在谈原文

仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档