AITOPAI热报
今日全部早读
地区
东盟中国趋势
外观
登录 / 注册
AITOPAI热报
全部动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
模型10:18
Intel AI PC集群推出大规模LLM分布式推理管道分片方案

Intel推出了在AI PC集群上实现大规模LLM分布式推理的片方法,能让集群共同计算超单台容量的模型,和单机相比效率更高。

aarXiv cs.AI原文
模型10:16
PGFS++:分子性质优化与合成多样性约束解决方案

PGFS++是新分子优化方法,能解决合成和多样性难题,比之前版本效果更好还保分子多样性。

aarXiv cs.AI原文
模型10:15
MDTIM模型用掩码扩散实现时间序列插值,性能领先

你说的那个MDTI模型,用掩码扩散来做时间序列插值,效果比之前的方法都强,感兴趣的话可以去了解下

aarXiv cs.AI原文
模型10:15
DA-WAM框架助力自动驾驶决策优化研究

DA-WAM是专门给自动驾驶做决策优化的框架,用它模拟未来场景选路径,比以前方法在NAVSIM那些测试里效果好,你感兴趣可以去了解下。

aarXiv cs.AI原文
模型10:15
ReWEIGH模型推出视觉证据校准方法缓解大模型幻觉

ReWEIGH模型校准方法能缓解大模型幻觉,比普通方法减少更多幻觉,操作简单。

aarXiv cs.AI原文
模型官方一手10:15
SPADE:自适应合成环境自博弈框架发布

你可以试试SPADE,它是让大语言模型自己学建环境,在数学题这些领域比固定环境方法强5.3%呢。

aarXiv: OpenAI原文
模型官方一手10:14
OpenAI 推出 Privacy Filter 模型卡

OpenAI发布了Privacy Filter模型卡,能高效处理文本隐私信息,效果比传统方案更专业。

aarXiv: OpenAI11 个信源在谈原文
模型10:14
Eureka任务条件元代理架构用于科学发现

Eureka模型发布了,能做科学发现任务,压缩输入还少重复计算,比以前方法强。

aarXiv cs.AI原文
模型官方一手10:12
Flama开源框架 支持生产级API与LLM服务开发部署

Flama这个开源框架,能帮你开发部署生产级API和LLM服务,和普通框架比更统一架构,还能自动处理多种模型格式。

aarXiv: Anthropic原文
模型官方一手11:54
CABLE:通过互补前导链接扩展记忆检索范围

清华团队提出CABLE方法,让AI记忆系统不再只靠相似度,而是通过互补链接找回被遗忘的关键信息。

aarXiv: DeepSeek原文
模型11:44
HLSR混合实时预测选择性动态车辆重路由框架

研究人员提出HLSR框架,能智能重规划车辆路线,有效缓解城市交通拥堵,比传统方法更精准高效。

aarXiv cs.AI原文
模型官方一手11:42
即时回合重复提升强化学习样本效率

这篇论文提出了一种简单却有效的IER机制,能让强化学习智能体通过重复成功动作更快学习。

aarXiv: Google DeepMind原文
模型10:30
Proteus:增量记忆激活用于长上下文序列建模

Proteus给长上下文模型加了个记忆开关,逐步解锁容量,让SWLA、Titans这些模型在长文本上表现更好,越长的上下文提升越明显。

aarXiv cs.LG原文
模型官方一手10:24
MAPLE:MoE模型自适应分层专家分配,75%专家超越原版

MAPLE这个插件能让MoE大模型少开专家还更准,DeepSeek-MoE-16B用75%专家就能超原版,还快32%,不用改权重就能用。

aarXiv: DeepSeek原文
模型10:02
FirstDiff:一步扩散模型实现多变量时序异常检测

不用跑完整扩散过程,第一次预测噪声就能判断异常,速度快还更准,时序异常检测可以看看这个方法。

aarXiv cs.AI原文
模型10:16
CytoBERT:面向细胞计数数据的基础模型

流式细胞数据太杂不好统一?CytoBERT在5000万细胞上预训练,换数据集微调即用,避免从头训练。

aarXiv cs.LG原文
模型10:15
DeaMoE:面向快速小批量解码的高效MoE结构

DeaMoE让MoE小批量解码少搬权重、跑得更快,7B模型在A40上TPOT提速33%,DeepSeek-V3加速近2倍。

aarXiv cs.LG2 个信源在谈原文
模型官方一手12:25
ARIES-Mission2:零样本VLA框架实现大规模无人机任务快速生成

这个框架让无人机看卫星图就能自动规划路线,比人工规划快3.6倍,飞行距离还缩短近10%,适合大规模任务。

aarXiv: DeepSeek原文
模型12:05
DFM Mimir v1:10亿参数HRM开源模型仅用许可数据达前沿性能

丹麦团队开源了10亿参数的Mimir v1,只用合规数据就追上4B模型,丹麦语还是第一。

aarXiv cs.AI2 个信源在谈原文
模型12:03
AlayaWorld v1.1技术报告:改进条件信号表示与集成

AlayaWorld v1.1报告出来了,空间记忆换成了3D点缓存渲染,条件编码统一到因果VAE,做世界模型的值得瞄一眼。

aarXiv cs.AI原文
模型11:08
Intern-S2-Preview:科学智能体基础模型发布

这个科学智能体模型能处理多模态数据,397B 版在时间序列预测上很强,还有个 4B 小模型能直接把生物任务分数拉高,适合搞科研的人看看。

aarXiv cs.LG原文
模型18:01
DreamFly:航空视觉语言导航的因果记忆与滚动扩散规划

做航空视觉语言导航的看这个:DreamFly在OpenFly上SR和SPL都超过现有方法,导航误差最低,还能判断何时到达。

aarXiv cs.AI原文
模型17:53
ScreenShot:用于小样本组合药物筛选的基础模型

想找有效的药物组合?ScreenShot不用分子图谱就能预测,少量样本就比现有方法准,还能省三分之二实验预算。

aarXiv cs.LG原文
模型17:44
FQTree:提升决策树的细粒度量化与硬件生成

FQTree把提升决策树的量化做到硬件级,在FPGA上能省26-57%查找表,精度还不掉,做边缘部署的可以看看。

aarXiv cs.LG原文
模型17:44
LIGHTYEAR:基于NTK的联邦学习个性化聚合新框架

联邦学习遇到非独立同分布数据时,LIGHTYEAR用NTK判断哪些更新对你有用,比单纯比参数靠谱,五个数据集上都赢了。

aarXiv cs.LG原文
模型12:35
Macaron-V1:开源持续学习模型家族,采用Mixture-of-LoRA架构

想了解怎么让模型部署后还能继续学?Macaron-V1用LoRA组合和递归改进做到了,744B大模型加四个专家LoRA,还开源。

aarXiv cs.LG原文
模型10:48
DynaCrys:动态空间群扩散晶体生成模型

DynaCrys把空间群和元素组成一起做扩散,两个评测引擎下都是最好成绩,生成还快,搞材料的人可以看看。

aarXiv cs.LG原文
模型12:25
SG-TULA:非凸非光滑采样的驯化次梯度算法

新采样算法SG-TULA能处理非光滑非凸问题,在GPT-2预训练上干赢了AdamW和Muon,还带理论保证。

aarXiv cs.LG原文
模型官方一手09:30
递归合成框架RST:低成本生成长时程终端任务

想低成本造高质量长任务数据?RST用递归验证把成本压到5分钱一个,还让模型成绩涨了10分,值得看看。

aarXiv: DeepSeek5 个信源在谈原文
模型09:22
iARCS:用于可控3D场景生成的迭代智能体强化学习

iARCS 用强化学习让 3D 场景生成器听懂自然语言要求,走路、够东西这些约束都能满足,还能提升基础生成器。

aarXiv cs.AI原文
模型11:47
MultiPathFormer:以多径传播为预训练目标的无线基础模型

想做无线信道估计或波束预测的可以看看,它用路径预测代替传统掩码重建,环境RAG让延迟估计直接涨59%,效果比现有模型好。

aarXiv cs.LG原文
模型11:47
POGP:连续控制的前缀最优动态扩散策略,学习何时停止

POGP能在保持性能的同时把去噪步数砍掉近三分之二,还比现有动态扩散方法更准,做连续控制的可以看看。

aarXiv cs.LG原文
模型11:43
CheMatE:联合学习SMILES与自然语言的化学嵌入模型

CheMatE让模型同时懂SMILES和化学文献,两阶段训练后在分子性质预测和科学理解任务上都不输基线。

aarXiv cs.LG原文
模型11:16
LAEF:面向即时诊断的导联无关心电图基础模型

这个LAEF模型专治心电图设备导联不全的痛点,手表或手持记录仪只用1-2个导联也能获得接近12导联的诊断效果,比同类小模型强不少。

aarXiv cs.LG原文
模型10:58
CARE-Bench:评估面向患者的医疗大模型分诊能力

这个基准测的是医疗分诊模型会不会乱建议,结果发现简单加提示词远远不够,做医疗AI的人都该看看。

aarXiv cs.AI原文
模型10:20
轻量化潜在推理世界动作模型LiLa-WAM用于机器人操作

LiLa-WAM用一张24GB显卡就能训练,在RoboTwin 2.0上50个任务做到90%以上成功率,还不用语言标注任务,做机器人操控的值得看看。

aarXiv cs.AI原文
模型10:19
TARL:长期智能体可执行记忆管理的交易感知可靠账本

长期智能体老是记错?TARL把记忆更新拆成五种动作,还带基准,比单纯写/忽略更靠谱。

aarXiv cs.AI原文
模型12:54
UEmbed:统一稀疏与稠密的多模态嵌入模型

想用一个模型同时搞定稀疏检索和稠密检索?UEmbed把两件事合成了一次前向,9B在MMEB-v2上分数还挺能打,多模态输入也支持。

aarXiv cs.AI原文
模型12:30
DyFrDet:动态频域抑制与标签消歧的小目标检测

新模型 DyFrDet 专治小目标检测,压频域噪声和标签歧义,代码开源了,跑个基准试试。

aarXiv cs.AI原文
模型官方一手12:10
LongCat稀疏注意力:流式感知分层跨层索引

DeepSeek稀疏注意力有个瓶颈,LongCat这套新方案用流式感知和跨层索引把它治了,跑长文本不慢,还开源了个69B模型,可以试试。

aarXiv: DeepSeek原文
‹ 上一页
123…8
下一页 ›
今日全部早读东盟登录