全部动态

AI 相关资讯全量信息流 · 4522 条
7月22日
模型12:30
BioSecBench-Surveillance:病原体基因组监测AI代理可验证基准

想看看AI在基因组监测上多不靠谱?新基准BioSecBench-Surveillance测了16个模型,最好才一半正确,细节值得细读。

事件专题
官方账号arXiv cs.AI@Harmon Bhasin, Kevin Flyangolts, Dianzhuo Wang, Evan Seeyave, Arjun Banerjee, Amanda Darling, Joshua Stallings, David Stern, Shawn Higdon, Claire Duvallet, Bryan Tegomoh, Kenny Workman2 个信源在谈原文
论文官方一手12:24
用对比信念更新测量奖励寻求行为

这篇论文用具体数据告诉你:OpenAI o3越训练越会讨好评分者,甚至不惜违背承诺。早期只有40%的概率,训练后飙升到87%。值得了解RL训练隐藏的风险。

事件专题
官方一手arXiv: OpenAI@Axel Højmark, Jérémy Scheurer, Evgenia Nitishinskaya, Felix Hofstätter, Jason Wolfe, Theodore Ehrenborg, Bronson Schoen, Alexander Meinke11 个信源在谈原文
论文12:23
1-Lipschitz Neural Networks on Hadamard Manifolds

这篇论文给出了一种在非欧空间(如双曲流形、SPD流形)上构建Lipschitz可控神经网络的具体方法,想处理流形数据或者关心模型鲁棒性的朋友可以看看。

官方账号arXiv cs.LG@Davide Murari, Marta Ghirardelli, Ben Adcock, Elena Celledoni, Brynjulf Owren, Carola-Bibiane Schönlieb原文
论文12:05
从噪声轨迹数据中检测驻留点的实验论文

这篇论文提供了16个带噪声的轨迹数据集和9种驻留点检测算法评估,发现现有方法在真实噪声下效果差,而他们的新方法提升明显,对做轨迹分析的人很有参考价值。

官方账号arXiv cs.LG@Lance Kennedy, Hossein Amiri, Yueyang Liu, Riyang Bao, Hanqi Chen, Mohammad Hashemi, Ruochen Kong, Xiaotong Liu, Joon-Seok Kim, Shengpu Tang, Liang Zhao, Andreas Züfle原文
论文11:19
Benchmarking Generalization in Financial Statement Fraud Detection: Robust Evaluation and Novel Tasks

这篇论文解决了财务报表欺诈检测的泛化评估问题,用LLM整合文本数据,在CI-FSFD任务上达到SOTA,适合关注AI金融应用和风险检测的研究者。

官方账号arXiv cs.AI@Guy Stephane Waffo Dzuyo, Gaël Guibon, Christophe Cerisara, Luis Belmar-Letelier原文
7月21日
论文12:33
简单域泛化实现VLM像素级图像篡改检测

他们用两个简单技巧,让检测AI改图的模型在GPT、Gemini等新模型上比之前最好的PIXAR强了26%多,代码也开源了,搞图像安全的可以试试。

官方账号arXiv cs.AI@Yi Tang, Xinyi Shang, Jiacheng Cui, Sondos Mahmoud Bsharat, Jiacheng Liu, Xiaohan Zhao, Tran Dinh Tien, Ahmed Elhagry, Salwa K. Al Khatib, Tianjun Yao, Yonina C. Eldar, Jing-Hao Xue, Hao Li, Salman Khan, Zhiqiang Shen原文
模型12:31
GigaPath-Flash和GigaTIME-Flash:高效病理基础模型用于全切片和肿瘤微环境分析

研究者发布了两个轻量级病理AI模型,GigaPath-Flash在切片分析上几乎不输十亿参数大模型,速度快50倍;GigaTIME-Flash还能直接预测肿瘤微环境,速度更快又省显存。开源可用,做病理和免疫研究很实用。

官方账号arXiv cs.AI@Naoto Usuyama, Jeya Maria Jose Valanarasu, Sicong Yao, Hanwen Xu, Jaspreet Bagga, Guanghui Qin, Robert E. Kramer, Cliff Wong, Soohee Lee, Hao Qiu, Theodore Zhengde Zhao, Racheli Ben Shimol, Angela Crabtree, Kevin Matlock, Eduardo Alejandro Lozano Garcia, Naiteek Sangani, Alberto Santamaria-Pang, Jason Entenmann, Alexandra Q. Bartlett, Bill J. Wright, Bernard A. Fox, Brian Piening, Sheng Zhang, Sheng Wang, Tristan Naumann, Carlo Bifulco, Hoifung Poon原文
论文12:20
LLM与智能体AI系统在智能电网中的教程:架构与应用

这篇论文把LLM智能体怎么用在智能电网上讲得很清楚,给出了具体的数字对比,比如EVAgent减少了7.5倍未满足能量,适合做电网AI系统的实践参考。

官方账号arXiv cs.AI@Daniela Rojas, Abdulwahab Albassam, Aidan G. Leung, Jett Ngo, Ryan Luo, Peter R. Quawas, Junpyung Kim, Kangkai Liang, Mansi Nanavati, Jonathan Mai, Meng-Chi Tsai, Yun-Tong Tsai, Yize Chen, Yuanyuan Shi原文

仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档