6月5日
6月4日
6月3日
11:49
11:49Geek@geekbb
精选
Ore Code 是一款专为 DeepSeek 设计的桌面端 AI 编码工作台,支持 macOS 和 Windows。它聚焦长上下文编码、结构化工具调用、本地项目上下文理解,并集成了 MCP 协议、技能和自动化功能。该项目已在 GitHub 开源,旨在为开发者提供更高效的 AI 辅助编程体验。
事件专题

推荐理由:如果你在用 DeepSeek 做编码,Ore Code 把长上下文、工具调用和项目上下文整合到了桌面端,省去来回切换的麻烦,做 AI 编程的开发者可以直接下载试试。
6月2日
22:55
22:55官方账号阶跃星辰 Stepfun@Stepfun_AI
Step 3.7 Flash 是一款面向快速智能体编码的开源权重模型,支持可靠工具调用和多模态理解。该模型已从模型卡片阶段进入实际编码工作流,由 @kilocode 团队在博客中详细介绍。其设计重点在于提升智能体编码效率,适合开发者集成到自动化编程任务中。这一进展标志着开源模型在实用化方面迈出重要一步。
推荐理由:做智能体编码的开发者终于有了一个可直接使用的开源模型——Step 3.7 Flash 的可靠工具调用和多模态能力能显著提升自动化效率,建议点开博客了解具体集成方式。
12:03
12:03官方账号arXiv cs.AI@Wenhao Wang, Peizhi Niu, Gongyi Zou, Xiyuan Yang, Jingxing Wang, Haoting Shi, Yaxin Du, Jingyi Chai, Xianghe Pang, Shuo Tang, Yanfeng Wang, Siheng Chen
精选72°
MCP-Persona 是首个专门评估 LLM 智能体在真实个人化 MCP 工具上表现的基准。它覆盖了 Reddit、小红书、飞书、Slack 等主流社交和协作平台,测试智能体与个人账户和本地数据库交互的能力。实验发现,当前最先进的智能体在处理个人化工具时表现挣扎,凸显了该基准在识别和解决这些局限性的关键作用。该基准已开源,可供开发者直接使用。
事件专题

推荐理由:MCP-Persona 填补了现有基准忽视个人化工具交互的空白,做智能体开发和 MCP 工具集成的团队可以直接用它来测试和优化自己的模型。
11:12
11:12官方账号arXiv cs.AI@Lichao Wang, Zhaoxing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai
SafeMCP 是一个服务器端防御插件,针对 LLM Agent 使用 MCP 协议时因动作空间扩大带来的安全风险。它通过内部世界模型进行前瞻推理,实现两层防御:主动工具过滤限制危险权限扩展,以及即时干预作为故障安全机制。训练采用三阶段流程:环境动态基础、安全策略初始化和带双重可验证奖励的强化学习。在 PowerSeeking Bench、ToolEmu 和 AgentHarm 上的实验表明,SafeMCP 能在降低风险的同时保持 Agent 的实用性。
推荐理由:做 LLM Agent 安全防护的团队终于有了一个可落地的方案——SafeMCP 在服务器端用前瞻推理主动过滤危险工具调用,比事后审计更有效,建议关注其开源实现。
09:29
09:29shao__meng@shao__meng
76°
Lee Robinson 分享了四条让代码库更适配 AI Agent 的原则:源码必须是真相或提供可编程访问路径(如 MCP/CLI),Agent 需能通过类型、测试、Linter 自检,AGENTS.md 应精简只写项目特有信息而非通用常识,以及通过自动化实现持续改进。他以 Cursor 官网从 CMS 迁回 Markdown 为例,说明移除抽象层后 Agent 效率显著提升。这些原则旨在降低 Agent 的认知与验证成本,让 token 和人力聚焦于产品价值。
事件专题

推荐理由:如果你的团队正在用 AI 编程助手或构建 Agent,这四条原则能直接帮你减少 Agent 的「猜错」和「瞎改」,从代码结构层面提升自动化效率。做工程基建或维护大型代码库的开发者,建议对照检查自己的仓库。
5月31日
5月30日
12:47
12:47官方一手marktechpost@Asif Razzaq
精选72°
Nous Research 的 Hermes Agent 新增 Tool Search 功能,用于解决 MCP(模型上下文协议)中的上下文膨胀问题。该功能采用 BM25 渐进式模式披露机制,能有效筛选相关工具。Anthropic 的评估显示,在 Opus 4 模型上,该方案将准确率提升了 49% 到 74%。这一改进对依赖 MCP 的 AI 代理系统意义重大,能显著减少无效信息干扰,提升任务执行效率。
事件专题

推荐理由:MCP 上下文膨胀是 AI 代理落地的常见痛点,Hermes Agent 的 Tool Search 用 BM25 精准筛选工具,做智能体开发的团队可以直接参考这个方案来优化自己的系统。
5月28日
10:12
10:12elvis@omarsar0
开发者@omarsar0提出,为了应对未来变化,AI系统应具备可组合性、迭代性和可定制性。具体包括LLM、评估、自动化、MCP/CLI工具、技能/记忆/上下文以及智能体框架(如Codex、Claude Code、Pi)等组件。这种设计能产生巨大的复合效应,让不同模块灵活搭配,适应快速演进的技术环境。
推荐理由:AI开发者常面临工具碎片化问题,这篇文章点出了可组合架构的核心理念——把LLM、评估、自动化等模块像乐高一样拼装,做Agent或工具链的团队值得参考。
5月26日