论文

arXiv 与期刊里的 AI 论文,每篇附中文摘要与推荐理由 · 5284 篇
9月15日
9月14日
研究提出新方法提升强化学习策略对抗输入扰动的鲁棒性

这是篇关于如何提升强化学习模型鲁棒性的研究论文,作者开源了实现代码,对做相关研究的人可能有参考价值。

arXiv cs.LG@Amine Andam 等 3 人原文
Nvidia Hopper GPU 大模型推理时 GPU 利用率分析研究

这个研究很实用,帮你理解为什么你的大模型推理时 GPU 利用率看起来很高,但实际计算效率可能很低。作者用具体的技术(vLLM、FlashAttention-3)和硬件(H100)做了实验,结论很扎实。

事件专题
arXiv cs.LG@Mohammad Siavashi 等 4 人2 个信源在谈原文
自适应舒适边界动作空间提升自动驾驶政策性能

这个研究解决了自动驾驶中一个很实际的问题,就是让AI驾驶更符合人类舒适感。他们开发了一个方法,让AI在控制车辆时更平滑,不会突然加速或转向,比之前的方法更好。

事件专题
arXiv cs.AI@Anna Rothenhäusler 等 7 人2 个信源在谈原文