23:35elvis@omarsar0精选Prime Agent 是一款开源的自我改进工具,适用于长期目标智能体工作。它通过持续的记忆和技能传递,使模型在每次运行中不断进步。ARC-AGI-3 RHAE 在最佳移动方面从30%提升到95.5%,并在长上下文编码、GPU内核生成和自主nanoGPT速度竞赛中与原生工具相匹配或超越。技巧Prime Agent自我改进工具ARC-AGI-3 RHAE1 个信源在谈事件专题推荐理由:Prime Agent 是一款非常有趣的自我改进工具,它能够显著提升模型的性能,值得一试。原文稍后读已读值得跟进有用关注 Prime Agent
10:52官方账号arXiv cs.AI@Seth Karten, Alex L. Zhang, Kevin Thomas, Sebastian Müller, Elie Bakouch, Daniel Auras, Mika Senghaas, Fares Obeid, Konstantin Dunas, Johannes Hagemann, Sami JaghouarPrime Agent 是一个开源的用于长期评估和编码代理工作流程的 harness。它通过 IPython REPL 和 Continual Harness 保留了历史、记忆、技能、提示和子代理规范,并通过直接代理间通信协调子代理。Prime Agent 将执行、恢复、验证和资源会计标准化,同时将策略构建留给模型。该 harness 将 ARC-AGI-3 RHAE Best@1 的成绩从 30% 提升至 95.5%,并在长上下文编码、GPU 内核生成、模拟器构建和自主 nanoGPT 快速运行方面与原生和流行的 harness 相匹配或超过。在 Factorio 上,我们发现改进允许持续的技术进步,而专用子代理能够实现并行化工作。代码可在 https://github.com/PrimeIntellect-ai/prime-agent 获取。AI模型Prime AgentRLM Harness递归语言模型1 个信源在谈事件专题推荐理由:Prime Agent 是一个强大的开源 harness,它通过递归语言模型和持续 harness 提高了长期评估和编码代理工作流程的效率,其性能在多个任务上超过了其他 harness,值得一试。原文稍后读已读值得跟进有用关注 Prime Agent
03:13OpenRouter@OpenRouterAIOpenRouter发布新工具Ori,用于在本地部署和管理Agent。通过`curl -fsSL openrouter.ai/labs/ori/insta… | bash`可完成安装,随后运行`ori prime`即可启动Prime Agent。该工具的相关文档已上线openrouter.ai/ori/harness。AI产品OpenRouterOriPrime Agent推荐理由:OpenRouter出了个命令工具Ori,一条curl装好就能跑Prime Agent,想快速上手Agent直接照抄这条命令。原文稍后读已读值得跟进有用关注 OpenRouter
10:33宝玉@doteyPrime Agent 是一个能自主改进的递归 Agent 框架。替换外部 Harness 后,Opus 5 的 ARC-AGI-3 评分从 30.2% 升至 95.5%,超过人类专家基线 95.4%。但作者认为,这种面向评分的优化价值有限,在现实场景中不会比 Claude Code 和 Codex 更好。AI模型Prime AgentOpus 5ARC-AGI-38 个信源在谈事件专题推荐理由:这个框架把 Opus 5 的评分从 30% 刷到 95.5%,但作者觉得换汤不换药,实战未必比 Claude Code 强。原文稍后读已读值得跟进有用关注 Prime Agent
22:17小互@imxiaohuPrime Agent是一个能自主改进的递归Agent框架。将Opus 5的外部框架替换为Prime Agent后,其ARC-AGI-3评分从30.2%提升到95.5%。这一成绩甚至超过了人类专家基线95.4%。该框架可直接作为Claude Code、Codex的替代品。开发者认为传统Agent框架的固定设计限制了模型发挥。AI产品Prime AgentOpus 5ARC-AGI-38 个信源在谈事件专题推荐理由:Prime Agent 这个递归框架挺有意思,直接把 Opus 5 的 ARC 成绩从 30% 拉到了 95%,还能替代 Claude Code 和 Codex,值得看看。原文稍后读已读值得跟进有用关注 Prime Agent
17:03官方一手marktechpost@Asif RazzaqPrime Intellect开源了Prime Agent,一个面向编程与研究的工作流框架。它基于递归语言模型,将子智能体调用封装为持久IPython内核中的函数。持续工作台(Continual Harness)允许智能体在运行中修改自身提示词、技能、记忆和子智能体规格。在ARC-AGI-3基准上,搭配Opus 5的Prime Agent取得95.5%的RHAE Best@1,超过人类专家基线95.4%。AI产品Prime AgentPrime Intellect智能体3 个信源在谈事件专题推荐理由:Prime Agent开源:子智能体是函数调用,可自改提示词,ARC-AGI-3超越人类基线。原文稍后读已读值得跟进有用关注 Prime Agent
10:18elvis@omarsar0Prime Intellect 推出了 Prime Agent,这是一个面向编程和长时自主任务的自我改进 RLM harness。它的设计通过程序化工具调用和把上下文当作变量来降低 token 消耗,并支持多智能体消息传递。harness 状态可以自修改,让 Agent 在任务运行中持续调整自身行为。整个方案强调 token 效率和表达能力,适合长时间自主执行的编码场景。AI产品Prime AgentPrime IntellectRLM2 个信源在谈事件专题推荐理由:Prime Intellect 发布了 Prime Agent,这个 RLM harness 能自我改进,编程和长时任务都能用,值得看看。原文稍后读已读值得跟进有用关注 Prime Agent