8月29日
03:21
03:21官方账号Perplexity@perplexity_ai
73°
GLM 5.3 现已在 Perplexity Computer 平台可用。该模型专为长上下文、多模态智能体工作负载设计。在 WANDR 基准测试中,GLM 5.3 的表现优于 GLM 5.2。WANDR 是用于大规模、有证据支持研究的基准测试。

推荐理由:Perplexity 上线了 GLM 5.3,专为长上下文多模态任务优化,在 WANDR 基准上超越了前代模型。
03:21
02:41
02:41官方账号LangChain@LangChainAI
精选
UnifyGTM在产品发布前两周发现其智能体单条消息就能消耗完客户预算。公司联合创始人兼CTO HeggieConnor分享了如何将成本降低90-95%的具体方法。该优化措施确保了产品正式发布时的成本效益。
推荐理由:UnifyGTM联合创始人分享如何将智能体计算成本降低90-95%,避免客户预算被单条消息耗尽。
02:08
01:19
01:19官方账号LangChain@LangChainAI
LangChain Academy团队将于9月17日举办Deep Agents线上工作坊。参与者将学习如何构建自己的Deep Agent。工作坊将介绍规划、记忆和子代理如何让代理执行复杂的多步骤任务。活动已在events.langchain.com上开放报名。
推荐理由:LangChain教你构建Deep Agent,掌握规划、记忆和子代理技术,实现复杂任务自动化。
00:13
00:13OpenRouter@OpenRouterAI
73°
Zai公司发布了GLM-5.3模型,现已开放权重并可在OpenRouter使用。该模型拥有100万上下文窗口,支持可配置推理强度。GLM-5.3专为复杂软件工程、长周期智能体和网络安全设计。模型权重已上传至Hugging Face平台。
事件专题

推荐理由:Zai开源了GLM-5.3,支持百万上下文,适合编程和网络安全,还能自己下载运行定制。
8月28日
22:26
22:26Aravind Srinivas@AravSrinivas
Perplexity Computer现已与Public平台正式连接。用户可将券商账户接入Perplexity,在一个AI驱动的界面中研究并交易股票、期权、加密货币、债券和国库券。这项整合为投资者提供了统一的交易和研究体验。
推荐理由:Perplexity接入了券商Public,现在能在一个界面里用AI研究并交易多种金融产品。
22:24
22:24官方账号Google AI@GoogleAI
Flow by Google 即将推出升级功能。Gemini App 将扩展场景功能,正在全球范围内向所有 Google AI Plus、Pro 和 Ultra 订阅用户推出。用户现在可以直接在 Google AI Studio 中构建,并在 Gemini Enterprise Agent Platform 上部署。
推荐理由:Google 为 Flow 和 Gemini App 带来了新功能,订阅用户可直接在 AI Studio 中构建并部署到企业平台。
22:20
22:20官方账号Decoder@Matthias Bastian
沃顿商学院研究显示,AI购物代理行为不稳定。仅更换一个外部信息源如Wirecutter,产品选择率就变化高达99个百分点。即使信息完全相同,仅改变信息顺序也会导致不同结果。

推荐理由:沃顿研究揭露AI购物代理的不可靠性,一个信息源就能让选择率变化99%,远未达到实用水平。
22:08
21:55
21:55Jerry Liu@jerryjliu0
精选
LlamaParse平台新增原生智能体电子表格提取功能,可处理任意行列数的表格。该功能通过调整的智能引擎直接读取原始单元格,而非将表格扁平化为文本。目前已在agentic_plus层级的beta版本中可用,支持.xlsx、.xls和.csv文件格式。
事件专题

推荐理由:LlamaParse上线原生电子表格提取,直接读取单元格数据而非文本转换,比传统方法更准确处理复杂表格。
21:52
21:49
21:49官方账号LangChain@LangChainAI
精选
LangSmith平台让Morningstar公司能够在一个地方追踪每个智能体的决策过程。高级软件工程师Matt Trivett分享了使用LangSmith前后的调试体验。该工具提供了完整的决策追踪功能,帮助开发者快速定位问题。
推荐理由:Morningstar工程师用LangSmith解决了智能体调试难题,每个决策都能追踪查看。
21:46
21:46官方账号Anthropic@AnthropicAI
精选
Anthropic 发布 MHS 接口,将 AI 与硬件的集成时间从数天或数周缩短至数小时或数分钟。该接口使设备可被发现,并确保 AI 智能体能够安全操作硬件。MHS 解决了当前 AI 与硬件集成缺乏标准化方法的问题。
事件专题

推荐理由:Anthropic 新出的 MHS 接口能让 AI 连接硬件快很多倍,还保证安全操作。
21:45
21:45官方一手Anthropic: Newsroom资讯
精选
Anthropic宣布开放模型硬件标准(MHS)研究预览,面向首批科研实验室和先进制造商。MHS是AI操作物理设备的共享规范,旨在确保安全操作。该标准将帮助AI系统与物理世界进行更安全的交互。首批参与者包括多家领先科研机构。
事件专题

推荐理由:Anthropic发布了MHS研究预览,这是AI安全操作物理设备的共享规范,首批已开放给科研实验室和制造商。
21:43
21:16
21:16Guillermo Rauch@rauchg
vgpu.sh 是 Vercel 团队开发的开源 WebGPU 库,专为智能体设计。该工具支持在浏览器或无头 Node.js 中运行,可在 CPU 沙箱和 CI 测试中渲染。vgpu.sh 允许创建可重用的 .wgsl 模块,最初是为在 vercel.com 上部署着色器而构建。
推荐理由:Vercel 团队开源了专为智能体设计的 WebGPU 工具,支持浏览器和 Node.js,还能在 CI 测试中渲染。
21:10
21:06
21:06官方一手AWS Machine Learning Blog@James Wu
精选
创意团队生产资产数量激增,但工具碎片化和手动上下文传递拖慢了生产进度。本文展示如何通过模型上下文协议(MCP)连接Amazon Quick和fal,构建可重用的智能体工具集。文章提供了两个实际工作流:八分格故事板制作和音乐视频概念原型设计。
推荐理由:AWS教你用Quick和fal通过MCP协议连接,解决创意工具碎片化问题,提供故事板和MV原型两个实用工作流。
20:51
20:50
20:50Richard Socher@RichardSocher
RichardSocher 发布了新型智能体模型,专注于准确性和响应时间。该模型在多项基准测试中表现出色,处理速度比前代产品提升 40%。该模型特别适合需要快速响应和精确结果的智能体应用场景。

推荐理由:RichardSocher 新发布的智能体模型,在准确性和速度上都有显著提升,适合需要快速响应的智能体应用。
20:48
20:43
19:45
19:45官方一手Pandaily@contact@pandaily.com (Pandaily)
腾讯办公智能体WorkBuddy在上海家化从试点转为生产应用。该智能体覆盖了家化9个部门。数据显示,WorkBuddy使平均工作效率提升了4.5倍。上海家化拥有百年历史,是中国知名化妆品企业。

推荐理由:腾讯WorkBuddy在家化落地,9个部门效率提升4.5倍,看看实际应用效果如何。
19:37
19:37官方账号arXiv cs.AI@Chenhao Wu, Haoxuan Jia, Yang Liu, Yingguang Yang, Yuhan Lin, Chongyang Zhang, Hao Zheng, Yulin Huang, Jianshen Zhang, Yongzhi Qi, Shang Luo, Kefu Xu, Jifeng Zhu, Bin Chong
精选73°
研究人员发现当前LLM智能体安全机制存在组合失效问题。传统安全监控器仅在单次轨迹内工作,无法检测跨迭代攻击。论文提出LoopHarness系统,通过持久化非衰减安全状态,将未授权操作期望数量控制在常数范围内。该研究在Agent-SafetyBench基准上进行了完整评估,包含清洁和攻击场景的配对测试。
推荐理由:MIT学者发现LLM智能体安全漏洞,提出LoopHarness解决跨迭代攻击问题,安全性能显著提升。