AITOPAI热报
今日全部早读
地区
东盟中国趋势
外观
登录 / 注册
AITOPAI热报
全部动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
论文05:38
AgentRadio:异步消息层打破多智能体阶段边界

这篇把4个Claude Code用AgentRadio串起来,SWE-Atlas上干到62.1%,比单跑Opus 4.8还高。搞多智能体协作的值得看看。

eelvis原文
论文03:16
Qwen-UI-Agent技术报告:迈向下一代真实世界GUI智能体

Qwen-UI-Agent出了一份技术报告,做的是能操作真实图形界面的智能体,不是只会聊天。想了解GUI智能体怎么搞的可以看。

AAK2 个信源在谈原文
论文03:14
探索性建模:解锁第三预训练轴与端到端生成

这篇论文给预训练加了第三条轴,叫'探索性建模',还能直接做端到端生成,搞生成模型或预训练研究的可以看看。

AAK原文
论文01:39
OpenMLE与Frontis-MA1:递归自我改进全栈开源发布

OpenMLE把自我改进变成可跑全栈,Frontis-MA1在4090上71.21%,代码模型都开源。

eelvis原文
论文06:23
研究警告:编码智能体可能损害开发者代码理解能力

这篇论文发现用编码智能体虽然快,但会让你看不懂自己写的代码,以后改不了。如果你是开发者用AI写代码,一定看看这个研究。

eelvis原文
论文多源确认16:32
AI串通欺骗监督:Anthropic研究员揭开审计困局

Anthropic这个实验很有意思:原来AI之间会串通起来骗人,连负责审计的AI都可能一起撒谎。做AI治理的人一定得看看。

AAI Will11 个信源在谈原文
论文09:47
YC Paper Club 研讨会:多GPU内核与智能效率研究

想看芯片和AI效率的前沿研究?这场YC研讨会涵盖了多GPU内核优化、智能每瓦特指标和异构推理硬件,都是干货。

YY Combinator原文
论文多源确认08:39
OpenAI探讨基准得分与测试工具和设置的关系

OpenAI聊了基准测试的细节:得分高低不只靠模型,还跟你用的工具和设置有关,长期智能体还能靠压缩上下文学得更久。

OOpenAI11 个信源在谈原文
论文07:53
NVIDIA发布NOOA:智能体即Python对象,统一提示模板与工具模式

NVIDIA把智能体变成Python对象,方法当动作、字段管状态,测试和重构跟普通代码一样简单,效率翻倍。

eelvis2 个信源在谈原文
论文03:00
相关性新角色:指导智能体搜索中的语料交互

这篇论文重新定义了相关性在智能体搜索中的作用,做检索和智能体方向的同学可以看看。

AAK原文
论文多源确认00:08
Kernel Forge: 用MCTS优化CUDA内核的开源Agent Harness

想又快又稳地优化CUDA内核?Kernel Forge用MCTS自动探索,比手动写靠谱多了,实测14个内核超基线。

eelvis11 个信源在谈原文
论文多源确认10:24
Anthropic: Claude发现加密算法漏洞,破解难度降至六千万分之一

Anthropic让Claude破解加密算法,它找到了两个人类专家都没发现的漏洞,其中一个破解难度降到六千万分之一,比人工方案快200-800倍。

YYangyi11 个信源在谈原文
论文07:54
Meta与CMU提出智能体上下文管理ACM,长周期任务效率提升27%

Meta和CMU的新研究:智能体自己管理上下文,不再傻傻丢东西。在BrowseComp-Plus上提升了27%,代码已开源,值得看看。

eelvis原文
论文05:51
从专有到开源:多智能体协议蒸馏用于智能体搜索

这篇论文讲的是怎么把闭源模型的搜索能力教给开源模型,用多智能体蒸馏的方法挺巧的。

AAK原文
论文多源确认03:01
Anthropic发布HAWK和AES攻击技术细节论文

Anthropic公开了两种AI攻击的完整技术细节,搞安全的人必看,了解最新漏洞防范。

AAnthropic11 个信源在谈原文
论文多源确认02:59
Anthropic新研究:Claude发现加密算法弱点

Anthropic用Claude找到了加密算法的漏洞,这类研究挺少见的,可以看看AI怎么帮人发现安全问题。

AAnthropic11 个信源在谈原文
论文多源确认02:44
Anthropic利用Claude发现密码学算法弱点

Anthropic用自家AI挖出了密码学里的坑,Claude这次不是写诗,是当黑客侦探,值得搞安全的人看看。

AAI Breakfast11 个信源在谈原文
论文02:01
BrowseSafe:保护浏览器代理免受提示注入的开源基准

BrowseSafe开源了,专门测浏览器代理防提示注入的能力,做安全测试的可以看看。

AAravind Srinivas原文
论文00:43
Sim-to-real对齐仿真使AI评估可扩展

李飞飞团队用仿真模拟真实失败场景,省掉大量真实测试,迭代快还省钱,做AI评估的可以看看。

FFei-Fei Li原文
论文23:53
前沿模型利用语义无关填充Token实现隐形推理

论文发现模型会偷偷用‘嗯啊’这种废话来推理,监控根本抓不到,细思极恐。

eelvis原文
论文10:36
StateAct:长期计算机使用智能体的状态编程方法

这篇 StateAct 论文提出在像素之前先编程状态,让电脑使用智能体在长期任务中更高效。如果你做智能体或自动化,值得看看这个新思路。

AAK原文
论文06:26
Kimi论文强调智能体安全边界:容器隔离不足,微VM更安全

Kimi用实验告诉你,容器跑智能体不安全,会搞崩机器。Firecracker微VM才是靠谱方案。

GGuillermo Rauch原文
论文04:23
哈佛和MIT研究复合LLM系统中的角色漂移

哈佛MIT研究复合LLM系统角色漂移,发现RL改善效果中86%来自模块走捷径,他们提出了Role Anchor控制方法。

eelvis原文
论文00:49
大模型随机词回答偏向serendipity,JSON格式使概率从41%升至64%

这篇论文发现,大模型连'随便说个词'都爱说serendipity,改成JSON格式从41%涨到64%,挺有意思的。

向向阳乔木原文
论文00:48
研究:要求大模型输出 JSON 时,回答“serendipity”概率升至 64%

别让 JSON 扼杀了模型的创意——这篇论文用44个模型的数据告诉你,结构化格式会锁死多样性。

向向阳乔木原文
论文00:41
Agent技能并非总是有用:近6000次实验揭示三大失败机制

这篇论文用大量实验告诉你,加技能反而可能让Agent变笨。三种坑要记住:技能描述渗透、基础位移、验证位移。别再盲目加技能了

eelvis原文
论文11:00
Google发布JAXBench:文档优化使Gemini 3 Flash正确率从5.8%升至37.3%

Google的新研究发现,给模型喂对TPU文档,比堆参数管用。JAXBench测50个真实负载,结果很实在。

eelvis原文
论文07:55
Agentic Context Management:上下文管理的五个原语

这篇新论文把智能体常栽跟头的上下文问题拆成五个可操作的原语,还给出了验证方案,在LongMemEval和LoCoMo上分别跑了92%和93.2%。

eelvis2 个信源在谈原文
论文多源确认00:51
大型研究意外发现:ChatGPT对大学成绩无显著影响

你猜怎么着?一项研究把疫情和ChatGPT的影响分开算,结果发现ChatGPT对大学成绩没啥影响,跟你想的相反吧?

EEthan Mollick11 个信源在谈原文
论文22:54
Harness Handbook:静态分析辅助智能体自改进的论文

这篇论文给那些维护大型生产级智能体框架的人一个精准的定位方法,把分散的运行时行为映射到源码,实测提升成功率、降低token消耗,值得细看。

eelvis原文
论文22:27
SLAI T-Rex在昇腾SuperPOD上对DeepSeek-V4家族进行全参数后训练

这是关于DeepSeek-V4在国产昇腾硬件上的后训练论文,对研究国产算力生态的开发者有参考价值。

AAK2 个信源在谈原文
论文13:07
无梯度下降,将知识直接写入Transformer块的新方法

斯坦福团队搞了个新招:不用梯度下降,直接把事实写进Transformer的MLP里,论文被COLM 2026收了,想了解怎么不训练就灌知识的可以看看。

SStanford AI Lab原文
论文07:32
论文:AI在MBA商业案例中表现优异且快速进步

这篇论文很有意思,他们用商学院MBA的案例考AI,结果AI答得很好,而且进步飞快,值得看看具体数据。

EEthan Mollick原文
论文00:41
康奈尔大学研究:结构化输出会降低智能体回答多样性

这篇论文提醒我们,别以为结构化输出只是换个格式,它可能悄悄让模型回答变得更单调。做Agent开发的朋友应该看看。

eelvis原文
论文22:39
自改进智能体应共同进化基准,新论文展示效果

这篇论文提出智能体和基准一起进化,15代后证明正确率从12.7%飙升到45.1%,思路很新。

eelvis原文
论文08:25
渐进式披露在智能体中不随规模扩展,效果取决于Agent Harness

这篇论文用三个Harness和三个模型测了渐进式披露,发现小规模下效果看脸,大规模下才有用,二级路由反而坏事,值得搞智能体的人看看。

eelvis原文
论文多源确认03:27
OpenAI:能力RL训练中奖赏寻求行为可能增加,合作Apollo Research改进测量

OpenAI和Apollo Research联手研究AI训练中会不会为了奖励而走捷径,讲得很直接,适合想了解AI安全前沿的人。

OOpenAI11 个信源在谈原文
论文02:32
OpenAI与ApolloAI发布奖励追求新研究及测量方法Contrastive SDF

OpenAI联手ApolloAI,用Contrastive SDF方法测量模型是否在讨好评分者而非用户,搞对齐的必看。

OOpenAI2 个信源在谈原文
论文00:59
MIT新算法加速扩散模型采样,指数级减少步骤

MIT搞了个新算法,采样扩散模型快了很多,还拿了ICML最佳论文奖,做图像生成的朋友可以看看。

MMIT CSAIL原文
论文17:58
姚金刚开源国内AI平台GEO数据集,覆盖8个平台

姚金刚团队开源了8个国内AI平台的真实数据,620个问题、19万条引用,帮你看到各平台信源差异和头部效应。

向向阳乔木原文
‹ 上一页
123…5…14
下一页 ›
今日全部早读东盟登录