全部动态
AI 相关资讯全量信息流
8月31日
Aero Hand Open:仿真就绪的肌腱驱动手
官方账号arXiv cs.LG@Nan Wang, Mohit Yadav, Jonathan Wulff, Aidan Rosenbaum, Kezhou Chen, Yuvan Sharma, Xu Dong, Yiwei Tao原文
MIT发布了仿真就绪的肌腱驱动手Aero,包含完整训练包,无需微调即可部署。
REPLICANT:规避与强化恶意软件检测器的新框架
官方账号arXiv cs.LG@Shae McFadden, Ilias Tsingenopoulos, Mario D'Onghia, Alexander Herzog, Myles Foley, Chris Hicks, Lorenzo Cavallaro, Fabio Pierazzi原文
REPLICANT 能让恶意软件绕过检测,还能帮安全人员训练更强大的检测器,效果提升近四成。
论文11:39
评分规则如何影响LLM预测性能这篇论文分析了不同评分规则对LLM预测行为的影响,帮你理解如何选择合适的训练目标。
神经网络模拟器实现等离子体实时控制
官方账号arXiv cs.AI@Nicola C. Amorisco, Kamran Pentland, Adriano Agnello, George K. Holt, Alasdair Ross, Matthew J. Marshall, Edward Jones, Graham J. McArdle, Charles Vincent, Timothy Nunn, Martin Kochan, Pedro Cavestany, Aran Garrod, Stanislas Pamela, James Buchanan原文
MAST-U实验首次验证了神经网络模拟器实时控制等离子体形状,比传统方法更灵活高效。
文本到SQL模块成本效益分析
官方账号arXiv cs.AI@Jiayan Lin, Yujia Liu, Zijin Hong, Zheng Yuan, Yilin Xiao, Hao Chen, Qinggang Zhang, Xiao Huang, Feiran Huang原文
这篇论文分析了文本到SQL中不同模块的成本效益,帮你决定哪些模块值得投入。
论文09:32
MAP:多模态无障碍规划基准测试MAP基准测试首次评估AI系统如何帮助有无障碍需求的用户规划实地访问,包含主张验证和视觉证据检索两项创新评估。
大语言模型语言自信与内部自信差异研究
官方账号arXiv cs.AI@Hefan Zhang, Bingquan Zhang, Ming Cheng, Saeed Hassanpour, Weicheng Ma, Soroush Vosoughi原文
8个分类任务+30个模型研究显示,LLM说的自信程度和实际内部自信经常不一致
奖励对齐的同策略蒸馏方法
官方一手arXiv: DeepSeek@Siyuan Gan, Yuhan Li, Xiran Wang, Linjian Meng, Boyan Wang, Zhen Zhao, Jing Huo, Yang Gao原文
论文提出RA-OPD解决教师模型误导问题,在数学和代码基准上显著提升性能。
仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。