论文Agent 与开发者精选10:33LLM生成资产壳质量评估方法研究工业4.0中,研究人员用三种模型测试了6400个资产壳实例,找到了评估AI生成资产壳质量的可靠指标。#AAS#GPT-4o-mini#Qwen3#DeepSeek-R1aarXiv: DeepSeek@Janek Groß 等 3 人原文稍后读已读值得跟进有用关注 AAS
论文Agent 与开发者多源确认10:33RAME框架在谷物育种信息提取任务中夺冠DeepSeek团队用RAME框架在谷物育种信息提取任务击败GPT-5.5,代码已开源。#RAME#DeepSeek-V4-Flash#GPT-5.5#信息提取3 个信源在谈事件专题aarXiv: DeepSeek@Hang Zhao, Jiahao Wang4 个信源在谈原文稍后读已读值得跟进有用关注 RAME
模型Agent 与开发者多源确认精选73°10:33DeepSeek-V4 长上下文服务系统 RedKnot-MLA 发布DeepSeek 推出了 RedKnot-MLA 系统,能显著提升长上下文服务的速度和效率,在多个基准测试中表现优异。#DeepSeek-V4#RedKnot-MLA#长上下文#多模态3 个信源在谈事件专题aarXiv: DeepSeek@Yang Liu 等 13 人4 个信源在谈原文稍后读已读值得跟进有用关注 DeepSeek-V4
论文Agent 与开发者精选10:32多租户LLM服务中KV缓存竞争可靠性研究研究揭示了多租户环境下LLM服务KV缓存时序攻击可靠性随负载变化的规律,对实际部署安全有重要参考价值。#KV缓存#时序侧信道#DeepSeek-R1-Distill-Llama-8B#vLLMaarXiv: DeepSeek@Rana Abu Bakar原文稍后读已读值得跟进有用关注 KV缓存
模型Agent 与开发者78°10:32PARSER:并行读取深度推理的长上下文智能体PARSER让长文档处理不再受顺序限制,证据位置变化不影响结果,推理速度提升11倍。#PARSER#长上下文#智能体#多跳问答aarXiv: DeepSeek@Kun Li 等 5 人原文稍后读已读值得跟进有用关注 PARSER
论文Agent 与开发者多源确认精选73°10:32SRD-GUARD:通过语义改写和多模型评分防御LLMSRD-GUARD能更好识别伪装攻击,在Llama-3和DeepSeek模型上表现优异,比现有防御方法有更好的DSR-ORR权衡。#SRD-GUARD#Llama-3-8B-Uncensored#DeepSeek-V4-Flash#AI安全2 个信源在谈事件专题aarXiv: DeepSeek@Qi Wang 等 3 人3 个信源在谈原文稍后读已读值得跟进有用关注 SRD-GUARD
产品Agent 与开发者多源确认精选73°10:23基于GPT-4的代码仓库分析聊天机器人这个GPT-4聊天机器人能让非技术人员轻松理解代码仓库数据,通过工具选择和提示工程提高分析准确性。#GPT-4#代码仓库#聊天机器人#提示词工程10 个信源在谈事件专题aarXiv: OpenAI@Muhammad Jawad Chowdhury, Md. Sakib Khan11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-4
技巧Agent 与开发者多源确认精选73°10:23AI编程代理配置供应链缺陷研究GitHub上16%的AI编程代理配置存在安全漏洞,开发者需警惕MCP服务器版本固定问题。#GitHub Copilot#Claude Code#Cursor#AI安全10 个信源在谈事件专题aarXiv: OpenAI@Benjamin Kapner 等 4 人11 个信源在谈原文稍后读已读值得跟进有用关注 GitHub Copilot
论文73°10:04ProcArena:多场景PL/SQL开发基准测试ProcArena基准测试首次全面评估了LLM在直接和交互式PL/SQL开发中的表现,覆盖157个数据库和9个子场景。#PL/SQL#ProcArena#PostgreSQL#OracleaarXiv cs.AI@Hang Zhang 等 15 人原文稍后读已读值得跟进有用关注 PL/SQL
模型Agent 与开发者73°10:03O2C-Nav实现高效零样本视觉语言导航O2C-Nav只需一次MLLM调用就能完成视觉语言导航,比现有方法更高效,代码已开源。#O2C-Nav#MLLM#视觉语言导航#R2R-CEaarXiv cs.AI@Shiqi Pan 等 6 人原文稍后读已读值得跟进有用关注 O2C-Nav
论文政策与合规精选10:02智能体决策因果归因研究欧盟AI法案要求高风险AI系统保持决策可追溯,这篇论文提供了实现这一目标的因果归因方法和规范。#因果归因#智能体#可追溯性#欧盟AI法案aarXiv cs.AI@Ajay Pravin Mahale原文稍后读已读值得跟进有用关注 因果归因
论文Agent 与开发者10:02COSTER框架提升自动驾驶安全场景生成COSTER框架通过时间反向生成技术,为自动驾驶训练创建了更真实多样的危险场景,碰撞率降低31%。#COSTER#自动驾驶#安全场景生成#WaymoaarXiv cs.AI@Taehyung Kim, Jongeun Choi原文稍后读已读值得跟进有用关注 COSTER
论文Agent 与开发者73°10:01MoE推理群体路由有效秩研究这篇论文揭示了MoE模型推理过程中路由相似性的集中-分化-再集中规律,为理解MoE内部计算提供了新视角。#MoE#路由有效秩#推理群体#数学/科学基准aarXiv cs.AI@Kang Chen 等 4 人原文稍后读已读值得跟进有用关注 MoE
论文Agent 与开发者精选10:01构建可信图智能体RAG框架这篇论文为图智能体RAG系统提供了完整的可信设计框架,特别关注社会应用场景下的可靠性和可追溯性。#Graph-Agentic RAG#RAG#检索增强生成#可信AIaarXiv cs.AI@Vijay Bommireddy, Raviteja Bommireddy原文稍后读已读值得跟进有用关注 Graph-Agentic RAG
论文Agent 与开发者10:00多智能体LLM评估的稳健共识方法这篇论文解决了LLM评估中的不确定性问题,通过多智能体共识方法让评估结果更可靠。#LLM-as-a-Judge#Conformal Prediction#多智能体#不确定性量化aarXiv cs.AI@Lihui Liu原文稍后读已读值得跟进有用关注 LLM-as-a-Judge
论文Agent 与开发者78°09:59AutoKD:自主知识发现框架AutoKD让AI自主完成知识发现,能积累发现并指导后续研究,在三个数据集上都表现出色。#AutoKD#LLM#多智能体#知识发现aarXiv cs.AI@Qinwen Ge 等 6 人原文稍后读已读值得跟进有用关注 AutoKD
论文73°09:59AGSA-Net:光谱解混遥感图像分类模型AGSA-Net将光谱解混与自注意力结合,在高光谱图像分类上表现优异,尤其适合城市场景分析。#AGSA-Net#光谱解混#高光谱图像#遥感aarXiv cs.AI@Nafisa Anjum 等 7 人原文稍后读已读值得跟进有用关注 AGSA-Net
论文Agent 与开发者73°09:59SVD压缩在注意力机制中的秩崩溃现象研究这篇论文揭示了SVD压缩在注意力机制中与秩崩溃的复杂关系,对模型压缩和优化有重要启示。#SVD#Transformer#注意力机制#秩崩溃aarXiv cs.AI@Anjaneya Teja Sarma Kalvakolanu原文稍后读已读值得跟进有用关注 SVD
论文Agent 与开发者73°09:51图神经网络中的回声室效应检测这篇论文揭示了图神经网络中一种新型故障模式,并提出了针对性的解决方案CASP,对GNN研究者和应用开发者很有价值。#图神经网络#回声室效应#GNNs#社区感知aarXiv cs.LG@Asela Hevapathige 等 4 人原文稍后读已读值得跟进有用关注 图神经网络
论文Agent 与开发者73°09:50Bi-HYCO框架解决PDE参数识别问题清华团队提出Bi-HYCO框架,解决PDE参数识别问题,在交互点耦合预测状态,实验效果优于传统PINN/XPINN方法。#PDE#参数识别#Bi-HYCO#偏微分方程aarXiv cs.LG@Umberto Biccari 等 4 人原文稍后读已读值得跟进有用关注 PDE
论文73°09:49结构熵驱动的图扩散生成方法SPIRESPIRE通过结构熵改进联邦学习中的客户端权重计算,在异构数据下效果显著。#SPIRE#联邦图学习#图扩散模型#结构熵aarXiv cs.LG@Shutong Zheng 等 5 人原文稍后读已读值得跟进有用关注 SPIRE
论文Agent 与开发者73°09:49OracleZoom实现递归图像超分辨率这个新框架解决了递归超分辨率中深度预测缺乏监督的问题,在深层放大上效果更好,还能减少幻觉现象。#OracleZoom#图像超分辨率#CLIPIQA#递归SRaarXiv cs.LG@Shubhashis Roy Dipta 等 4 人原文稍后读已读值得跟进有用关注 OracleZoom
论文Agent 与开发者精选09:49二阶平滑规划与最优传输贝尔曼平滑新论文提出SecondOrderSmoothCruiser,比SmoothCruiser复杂度更低,只需O(ε⁻³)就能完成规划任务。#SecondOrderSmoothCruiser#SmoothCruiser#贝尔曼备份#最优传输aarXiv cs.LG@Tuan Dam原文稍后读已读值得跟进有用关注 SecondOrderSmoothCruiser
论文09:48参数修剪如何重塑DNN表示这篇论文解释了为什么修剪某些参数会导致DNN性能大幅下降,而其他参数则不会。#参数修剪#DNN#深度神经网络#交互模式aarXiv cs.LG@Fangbo Li 等 4 人原文稍后读已读值得跟进有用关注 参数修剪
论文Agent 与开发者精选09:47量化大模型中的激活转向研究这篇论文揭示了量化大模型中激活转向技术的真实表现,特别是推理长度任务中的不对称现象值得开发者关注。#量化#激活转向#LLM#INT8aarXiv cs.LG@Saurav Bhandari, Benjamin Wade原文稍后读已读值得跟进有用关注 量化
论文Agent 与开发者73°09:47OSOL缓解多领域强化学习中的高阶干扰清华团队提出OSOL方法,通过分析token足迹解决多领域RL性能退化问题,在Qwen3-30B-A3B上提升5.7%性能。#OSOL#Qwen3-30B-A3B#强化学习#多领域aarXiv cs.LG@Zihan Lin 等 7 人原文稍后读已读值得跟进有用关注 OSOL
论文Agent 与开发者精选09:46表现强化学习的局部与全局稳定性研究这篇论文解决了表现强化学习中稳定性理论的关键问题,提出了新的收敛保证和假设条件。#表现强化学习#混合策略#Hedge算法#马尔可夫游戏aarXiv cs.LG@Debmalya Mandal原文稍后读已读值得跟进有用关注 表现强化学习
论文Agent 与开发者73°09:46掩码预训练理论框架研究这篇论文解释了掩码预训练的工作原理,提出了能解决维度坍缩问题的U-MPT方法,还给出了新的掩码策略。#MPT#U-MPT#掩码预训练#自监督学习aarXiv cs.LG@Qi Zhang 等 4 人原文稍后读已读值得跟进有用关注 MPT
论文Agent 与开发者73°09:45分解LLM评估器不确定性以定位专家标注这篇论文教你如何让LLM评估器更聪明地知道何时需要专家帮助,而不是盲目地寻求所有答案。#LLM-Judge#贝叶斯模型#不确定性分解#ChaosNLIaarXiv cs.LG@Ryan Lail原文稍后读已读值得跟进有用关注 LLM-Judge
论文09:45大规模预训练提升DWI几何畸变校正医学影像领域新研究,用预训练模型提升DWI畸变校正效果,在LMIC数据应用中发现实际挑战。#DWI#几何畸变校正#cWDM#深度学习aarXiv cs.LG@Saroj Khanal 等 15 人原文稍后读已读值得跟进有用关注 DWI
论文Agent 与开发者精选09:45两层量化神经网络STE训练稳定性研究这篇论文从统计学习理论角度解释了STE训练的稳定性与泛化能力,给出了明确的误差边界和收敛速率。#STE#量化神经网络#统计学习理论#泛化边界aarXiv cs.LG@Yiming Ying原文稍后读已读值得跟进有用关注 STE
产品Agent 与开发者11:38Diffusion TV:通过实体交互体验扩散模型MIT 团队打造实体化 AI 艺术装置,通过物理操控电视天线体验扩散模型生成过程,比纯软件交互更直观。#Diffusion TV#扩散模型#AI艺术#实体交互aarXiv cs.AI@Sihwa Park原文稍后读已读值得跟进有用关注 Diffusion TV
论文Agent 与开发者11:37IIns-GAN生成带标签无线信号模型DeepSeek团队推出IIns-GAN,能生成真实无线信号,比传统方法更省成本,还能提升各种无线感知任务的训练效果。#IIns-GAN#无线信号#深度学习#UWBaarXiv cs.AI@Yuxiao Li 等 4 人原文稍后读已读值得跟进有用关注 IIns-GAN
论文Agent 与开发者精选73°11:37韩国开放API基准与多步工具调用数据合成韩国团队推出首个多步工具调用基准,用动态图方法合成数据,小模型也能接近大模型效果。#KOPA-Bench#EDGE#多步工具调用#APIaarXiv cs.AI@Dain Kim 等 5 人原文稍后读已读值得跟进有用关注 KOPA-Bench
论文Agent 与开发者78°11:37UniMate:统一模型实现多样化骨骼动画UniMate无需测试时优化或每骨架重新训练,就能为任意骨骼生成动画,解决了现有动画师受拓扑限制的问题。#UniMate#拓扑感知扩散变换器#骨骼动画#3D资产aarXiv cs.LG@Linzhan Mou 等 7 人原文稍后读已读值得跟进有用关注 UniMate
论文Agent 与开发者11:37LLM解释评估研究:必要性与充分性分析这项研究揭示了LLM解释与实际决策行为之间的差距,对AI系统监控和错误诊断有重要参考价值。#LLM#Claude#GPT#GeminiaarXiv cs.AI@Urja Pawar 等 7 人原文稍后读已读值得跟进有用关注 LLM
论文Agent 与开发者精选73°11:36RegionFed:联邦学习实现零售个性化查询理解RegionFed解决了联邦学习中transformer模型崩溃问题,在T5-Small到T5-3B等多种架构上实现零代码部署,准确率接近集中式模型。#RegionFed#联邦学习#transformer#差分隐私aarXiv cs.LG@Quoc H. Nguyen 等 7 人原文稍后读已读值得跟进有用关注 RegionFed
论文Agent 与开发者精选73°11:36Ref-GeNVS实现镜像场景新视角合成Kim团队提出Ref-GeNVS,让多视角扩散模型能正确处理镜像反射,无需微调就能生成一致的新视角。#Ref-GeNVS#NVS#多视角扩散模型#镜像场景aarXiv cs.AI@GeonU Kim 等 3 人原文稍后读已读值得跟进有用关注 Ref-GeNVS
论文Agent 与开发者精选73°11:36蒸馏全局知识,适应本地需求:可扩展升级推荐框架这个框架让LLM推理能力提升5000倍速度、降低10000倍成本,专为大规模产品升级推荐设计。#LLM#推理蒸馏#测试时训练#推荐系统aarXiv cs.LG@Siliang Liu 等 4 人原文稍后读已读值得跟进有用关注 LLM
论文Agent 与开发者11:35大模型在分子属性基准中存在数字记忆现象最新研究揭示大模型在分子属性预测中存在数字记忆现象,影响模型评估准确性。#LLM#分子属性#基准测试#verbatim检索aarXiv cs.AI@Matthias Busch 等 7 人原文稍后读已读值得跟进有用关注 LLM