01:33Varun Mohan@_mohansoloGemini 3.8 Flash已正式发布,相比3.7 Flash版本在智能体编程和通用知识工作方面有显著提升。该模型已在内部团队中使用并获得良好反馈。现在所有用户都可以通过Antigravity平台访问这一新版本。AI模型GeminiGemini 3.8 FlashAntigravity10 个信源在谈事件专题推荐理由:Google发布了Gemini 3.8 Flash,在编程和知识工作上比前代更强,现在人人都能用。原文稍后读已读值得跟进有用关注 Gemini
01:12OpenRouter@OpenRouterAIGemini 3.8 Flash新增智能体视频处理功能。用户可在视频部分设置processing参数为"agentic"。模型能自主导航时间轴,而非以固定速率采样每一帧。该功能也适用于早期Gemini Flash模型。AI产品Gemini 3.8 FlashOpenRouter智能体10 个信源在谈事件专题推荐理由:OpenRouter宣布Gemini 3.8 Flash支持智能体视频处理,能自主导航时间轴,比固定帧采样更高效。原文稍后读已读值得跟进有用关注 Gemini 3.8 Flash
00:46elvis@omarsar073°Google DeepMind推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型。Gemini 3.8 Flash在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。Gemini 3.8 Flash Cyber是谷歌最强大的网络安全模型,具备前沿级别的漏洞检测和自动修补能力。两款模型均位于帕累托前沿,性能表现优异。AI模型GeminiGemini 3.8 FlashGoogle DeepMind10 个信源在谈事件专题推荐理由:谷歌发布Gemini 3.8 Flash系列,新增网络安全版本,在漏洞检测和修补方面表现突出。原文稍后读已读值得跟进有用关注 Gemini
00:45官方账号Google DeepMind@GoogleDeepMind谷歌推出Gemini 3.8 Flash模型,在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。同时发布Gemini 3.8 Flash Cyber模型,具备前沿级漏洞检测和自动修补能力。这两个新模型旨在帮助扩展AI代理并保障代码安全。AI模型Gemini3.8 Flash3.8 Flash Cyber推荐理由:谷歌发布了Gemini 3.8系列模型,一个提升推理能力,一个专注网络安全,都是各自领域的升级款。原文稍后读已读值得跟进有用关注 Gemini
00:40小互@imxiaohu73°Claude Fable 5.1 更擅长长时间执行复杂任务,官方发布 16 条提示词建议。新模型在 high 算力档位表现最佳,medium 可平替上一代且更便宜,low 甚至能抗衡 Opus/Sonnet。代码执行时应提示工具一次性并发调用,避免单步低效操作。复杂任务需防半途停顿,可设置非破坏性操作直接执行规则。技巧Claude Fable 5.1提示词工程智能体7 个信源在谈事件专题推荐理由:Fable 5.1 发布实用提示指南,教你解决复杂任务执行、工具并发和上下文管理等痛点原文稍后读已读值得跟进有用关注 Claude Fable 5.1
00:28官方账号Logan Kilpatrick@OfficialLoganK73°Google推出Gemini 3.8 Flash模型,这是6周内第三个更新的Flash版本。该模型在智能体和编程能力方面有明显提升。Gemini 3.8 Flash是Google快速迭代的产品线之一。AI模型GeminiGemini 3.8 Flash智能体10 个信源在谈事件专题推荐理由:Google发布Gemini 3.8 Flash,6周内第三次更新Flash模型,智能体和编程能力又有提升。原文稍后读已读值得跟进有用关注 Gemini
00:15Philipp Schmid@_philschmid73°Google在6周内发布第三个Flash版本,专注于实际工程、长期任务和智能体自主性。Gemini 3.8 Flash在所有领域表现均优于3.7 Flash版本,定价为每100万token 0.75美元/3.75美元。该模型采用更小步骤并更频繁验证工作,虽然会增加token使用量,但能有效提高复杂和长期目标的工作质量。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google发布Gemini 3.8 Flash,比前代表现更好,特别适合复杂编程和智能体任务。原文稍后读已读值得跟进有用关注 Gemini
00:14AI产品黄叔@PMbackttfuture用户创建了Grok Bot的黄叔分身,只需分配任务,Bot会自动在群组中@其他Bot协作完成,最后向用户汇报。这种工作流程模拟了董事长给总经理布置任务的模式,Bot能自主组织资源完成工作。Grok Bot的开源玩法手册由多个Bot协作自动更新。AI产品GrokBot智能体推荐理由:Grok Bot能创建分身自动完成群组任务,像给总经理布置工作一样省心,还能@其他Bot协作。原文稍后读已读值得跟进有用关注 Grok
00:08官方账号Google AI@GoogleAI73°谷歌推出Gemini 3.8 Flash模型,专为处理复杂智能体和多步骤任务设计。该模型在推理能力方面有显著提升,不仅能编写代码还能导航复杂项目。Gemini 3.8 Flash结合原生视频理解和高级编程功能,可自主构建3D游戏、测试并修复错误。模型配备了努力控制机制,确保思考量与消耗的token成正比。AI模型GeminiGemini 3.8 Flash智能体10 个信源在谈事件专题推荐理由:谷歌新发布的Gemini 3.8 Flash能自主完成复杂项目,比前代模型推理能力更强,还支持视频理解与编程的智能体循环。原文稍后读已读值得跟进有用关注 Gemini
00:03Martin Fowler@martinfowler精选Giles Edwards-Alexander报道了一个团队意外触发智能体群在Git仓库中创建黑板协调系统的案例。该系统实现了多智能体间的信息共享与协作。研究展示了智能体系统在未明确指令下的自组织能力。这一案例发生在martinfowler.com网站的技术文章讨论中。技巧智能体Git黑板系统推荐理由:团队意外让智能体在Git仓库里建了个协作系统,看看怎么发生的原文稍后读已读值得跟进有用关注 智能体
23:48elvis@omarsar078°字节跳动Seed团队提出HarnessDev方法,不再评估模型完成任务的表现,而是评估其构建的智能体框架。该框架从弱种子和少量案例开始,构建完整执行系统,再通过下游反馈改进。实验涵盖6个创作者LLM、4个领域和2207个保留下游实例。结果显示,生成的框架在代码和搜索研究方面落后于成熟的人工工程参考,但在写作和机器学习实验方面与之相当或更优。论文HarnessDevByteDance智能体推荐理由:字节跳动新出的HarnessDev框架,让AI从完成任务进化到构建智能体,在写作和ML实验上已能匹敌人工工程。原文稍后读已读值得跟进有用关注 HarnessDev
23:33IT之家(博客/媒体)精选73°谷歌在 Google DeepMind 网站上线了 Gemini 3.8 Flash 模型,基于 Gemini 3.7 Flash 开发。该模型拥有最高 1M token 上下文窗口和 64K token 文本输出能力。在编程、知识处理、多模态处理等基准测试中表现优异。模型面向个人用户、开发者和企业,适合软件工程和智能体任务场景。AI模型GeminiGemini 3.8 Flash谷歌10 个信源在谈事件专题推荐理由:谷歌新发布的 Gemini 3.8 Flash 模型,在软件工程和智能体任务方面有提升,支持自定义努力水平,适合大规模部署。原文稍后读已读值得跟进有用关注 Gemini
22:44Patrick Loeber@patloeber73°Google昨日发布了基于Gemini的智能体视频理解功能。该功能由@MaartenGr制作视频详细解释。视频在YouTube上获得1268次观看。这项技术允许AI系统理解视频内容并执行相关任务。AI产品Gemini智能体视频理解推荐理由:Google刚发布了Gemini的智能体视频理解功能,有详细视频演示,看看它如何工作。原文稍后读已读值得跟进有用关注 Gemini
22:43elvis@omarsar0Catch AI是一款面向高管的行政助手AI产品。该产品能够处理日程安排、邮件管理和差旅事务。Catch AI能够智能存储用户偏好,主动执行任务而非仅提供建议。Nir Sabato领导的团队推出了这款产品,专注于完成高管讨厌的行政工作。AI产品Catch AI行政助手智能体推荐理由:Catch AI直接帮你处理行政琐事,比普通AI助手更主动,专为忙碌高管设计。原文稍后读已读值得跟进有用关注 Catch AI
19:28IT之家(博客/媒体)宏碁推出基于英特尔酷睿Ultra X7 358H处理器的Veriton RI110迷你主机AI工作站。该设备尺寸为138.5×131.3×52.1mm,重量约0.63kg,支持96GB LPDDR5X内存和4TB M.2 2280 PCIe Gen4固态硬盘。Veriton RI110配备丰富的外部接口,包括2个USB-C 40Gbps端口和1个10GbE RJ-45接口。该设备支持Acer Qubi Claw智能体,可在隔离式沙箱环境中执行本地工作流。AI产品Veriton RI110AcerQubi Claw推荐理由:宏碁这款迷你AI工作站性能强劲,支持本地智能体执行多种任务,接口丰富实用。原文稍后读已读值得跟进有用关注 Veriton RI110
17:58IT之家(博客/媒体)《后西游记》是国内首部AIGC长剧,于8月31日在芒果TV上线。该剧30集、每集40分钟,从策划到上线时间较传统三维动画减少70%。总成本约为同类S级真人剧的几分之一,采用边制作、边审核、边播出的创新模式。该剧对男性用户拉新率超出预期,验证了AI长剧在拓宽用户结构上的价值。AI产品AIGC后西游记芒果TV推荐理由:芒果TV推出国内首部AIGC长剧《后西游记》,制作时间减少70%,成本仅为真人剧几分之一,还拉来了更多男性用户。原文稍后读已读值得跟进有用关注 AIGC
17:08Dify@dify_aiDify Agent 是一款可独立使用或集成到工作流中的 AI 智能体。新用户可以通过官方指南快速了解如何构建和管理 Agent。该产品已在 cloud.dify.ai 平台上线,目前已有 228 次浏览。AI产品DifyDify Agent智能体推荐理由:Dify 推出新 Agent 产品,教你如何独立使用或集成到工作流中,上手简单实用。原文稍后读已读值得跟进有用关注 Dify
16:35官方账号Decoder@Jonathan Kemper精选73°Google为Gemini 3.7 Flash、3.6 Flash和3.5 Flash-Lite添加了基于智能体的视频分析功能。该模型自主决定检查哪些片段以及以何种分辨率检查,不再以固定速率逐帧扫描视频。Google表示这种方法可将token使用量减少高达88%,同时提高准确性,尤其对于多小时的录像效果显著。AI产品GeminiGemini 3.7 Flash视频分析推荐理由:Google给Gemini Flash系列加了智能视频分析,能自己决定看哪些片段,省token高达88%,看长视频更准。原文稍后读已读值得跟进有用关注 Gemini
15:58IT之家(博客/媒体)豆包工作新增多 Agents 并行功能,可召唤不同子 Agent 同时执行任务模块。Mac 系统下新增操作电脑功能,无需 MCP、API、插件和 CLI 即可实现本地 GUI 操作。豆包工作是字节跳动于 2026 年 8 月 25 日推出的 Agent 产品,定位为 AI 办公场景统一入口。AI产品豆包工作多 AgentsMac推荐理由:字节跳动豆包工作上新,能同时调用多个智能体干活,还能在 Mac 上直接操作电脑界面。原文稍后读已读值得跟进有用关注 豆包工作
14:53shao__meng@shao__mengAnthropic重新设计了六个阶段的代码开发流程,形成产物链闭环。每个阶段提交一个文件,下一阶段读取后继续。人类只在关键节点进行审阅,Agent无法越过生产门。这种设计解决了AI代码生成速度与人工评审节奏不匹配的问题。技巧Anthropic代码开发Agent9 个信源在谈事件专题推荐理由:Anthropic把六个开发阶段串成闭环,AI写代码快了,人只审关键节点,效率不再被流程消耗。原文稍后读已读值得跟进有用关注 Anthropic
14:48IT之家(博客/媒体)阿里云今日推出企业级人与 Agent 协作平台“万有无界”,已开启公测。该平台支持调用阿里最新旗舰模型 Qwen3.8-Max,采用多角色 Agent 协作模式。平台设有“小万”和“小有”两个主 Agent,分别担任个人助理和项目经理角色。万有无界强调组织记忆与流程资产全部归属企业账户,确保组织能力连续性。AI产品万有无界阿里云Qwen3.8-Max推荐理由:阿里云推出的万有无界平台,让多个 Agent 协作完成任务,企业可沉淀数字资产,比传统 AI 工具更适合团队协作。原文稍后读已读值得跟进有用关注 万有无界
14:23Gary Marcus@GaryMarcusGary Marcus指出AI安全三支柱即将崩塌。未来可能出现高度能力但难以监控且对齐存疑的AI智能体。这些智能体将在全球最具影响力的组织中自主工作。Marcus强调高能力系统不应设计为难以监控或对齐存疑。行业Gary MarcusAI安全智能体推荐理由:Gary Marcus警告AI安全三支柱面临崩塌,未来可能出现难以监控且对齐存疑的AI智能体在关键组织中自主工作。原文稍后读已读值得跟进有用关注 Gary Marcus
14:08IT之家(博客/媒体)精选努比亚NaviX Ultra已获入网许可,搭载豆包手机助手。该手机支持全场景自然语义理解,可自主跨软件完成多步骤任务。核心大模型运算全部在手机端本地完成,用户数据无需上传云端。努比亚NaviX Ultra将搭载骁龙8 Elite Gen5处理器,内置7000mAh电池。AI产品努比亚豆包NaviX Ultra推荐理由:努比亚9月将推出豆包手机,本地运行大模型,数据不上云,还能跨软件完成任务。原文稍后读已读值得跟进有用关注 努比亚
13:18官方一手marktechpost@Asif Razzaq精选Perplexity本周为Mac平台推出混合计算功能。该功能将单个任务分配给云端前沿模型和本地模型。云端智能体负责编排,敏感数据在设备端处理。这一方案解决了智能助手的结构性问题。AI产品Perplexity混合计算Mac推荐理由:Perplexity在Mac上实现了云端与本地模型的协同,敏感数据无需上传云端。原文稍后读已读值得跟进有用关注 Perplexity
12:47AI产品黄叔@PMbackttfuture精选Grok Bot分身可自动转发任务到群组,指挥其他BOT完成任务,并在私聊窗口汇报结果。该产品提供8核/16G内存/126G硬盘专享资源,包含Grok额度及DeepSeek API调用权限。操作极简且无需理解服务器配置。用户可通过网站grokbot.aihuangshu.com获取《Grok Bot 橙皮书》和awesome-grok-bot资源。AI产品GrokGrok BotDeepSeek1 个信源在谈事件专题推荐理由:黄叔用Grok Bot做了个任务自动化分身,能指挥其他BOT干活,还整合了橙皮书资源。原文稍后读已读值得跟进有用关注 Grok
12:23AI Engineer@aiDotEngineer精选AI Engineer World's Fair 2026上线智能体商务专题,包含10场演讲。Google DeepMind的Nidhi Kaushik Vyas探讨多模态协作智能体在下一代商务中的应用。Circle的Harshal Bhangale分析AI智能体为何需要钱包。AWS的Anil Nadiminti讨论AI智能体支付与卖家变现问题。行业智能体AI Engineer World's FairGoogle DeepMind推荐理由:AI工程师世界博览会2026上线智能体商务专题,10场演讲探讨AI智能体如何花钱、变现和支付控制。原文稍后读已读值得跟进有用关注 智能体
12:23Hailuo AI@Hailuo_AIMiniMax的H3 Max模型被用于构建名为"THIS WAY"的实时电影引擎。该引擎能记住角色、故事线和后果,观众可实时投票选择故事走向。系统会生成两种未来,胜出者成为故事主线并继续发展。这标志着AI从无限生成转向服务实际剧情的重要一步。AI产品H3 MaxMiniMax互动电影2 个信源在谈事件专题推荐理由:MiniMax用H3 Max做了个互动电影引擎,观众投票决定剧情走向,AI服务故事而非无限生成。原文稍后读已读值得跟进有用关注 H3 Max
12:18量子位@杰西卡百融硅基推出企业级Agent解决方案,AI客服日处理1.5万通电话。该系统已实现员工批量上岗,采用按结果计薪模式。AI客服在准确率和响应速度上达到人工客服水平。AI产品百融硅基企业级AgentAI客服推荐理由:百融硅基的AI客服已能替代人工,每天处理1.5万通电话,还按效果付费。原文稍后读已读值得跟进有用关注 百融硅基
12:13Yangyi@Yangyixxxx精选互联网数据大多被腾讯和字节掌握,垂直领域数据竞争激烈。物理世界依赖硬件设施获取上下文,存在不同机会。Agent需要工具获取新能力和上下文,突破模型智力限制。深圳硬件连接物理世界的数据可能塑造新公司。Sleepagotchi将可穿戴设备数据转化为行动,展示Agent应用实例。技巧AgentSleepagotchi硬件推荐理由:Sleepagotchi将Apple Watch等设备数据转化为行动,展示Agent如何通过硬件连接物理世界。原文稍后读已读值得跟进有用关注 Agent
11:14小互@imxiaohu73°ChatGPT Work与Codex产品负责人Tara Seshan探讨了AI智能体作为持久在线同事的协作模式。她提出AI能在后台持续工作,带着项目上下文交付结果并允许人随时纠偏。Tara将模型、运行环境、权限、协作界面和人的责任整合在同一框架中。当执行成本下降后,人的职责转向方向、品味、表达、问责和关系管理。行业ChatGPT WorkCodex智能体推荐理由:Tara Seshan分享AI智能体如何从任务执行者转变为长期协作伙伴,改变产品设计和个人能力要求。原文稍后读已读值得跟进有用关注 ChatGPT Work
10:49官方账号arXiv cs.AI@Kshitij Tayal, Arun Sharma, Genta Indra Winata, Anirban Das, Sambit Sahu精选73°自然语言正成为提升语言智能体的主要反馈渠道,能传达意图、偏好和因果结构。该研究提出语言强化学习(VRL)范式,围绕反馈生效时机和修改内容形成三大支柱:语言作为基础信号定义任务目标和奖励结构;语言作为反思性反馈指导测试时推理;语言作为学习信号通过训练调整模型参数。论文语言强化学习语言智能体VRL推荐理由:这篇论文首次系统梳理了语言强化学习,将现有研究分为三大类,帮助理解语言如何重塑智能体开发。原文稍后读已读值得跟进有用关注 语言强化学习
09:53shao__meng@shao__meng精选73°Google DeepMind SVP Koray证实Gemini 4是公司迄今最具雄心的预训练运行,目前进展顺利但保持谨慎乐观。他承认当前Gemini模型质量略低于前沿,但强调Google正从模型向智能体转型。Gemini 3.5 Pro仍在开发中,但优先级低于Flash系列。Koray认为AGI没有测试阈值,而是信任的逐步建立。行业GeminiGoogle DeepMindAGI推荐理由:Google首席AI架构师揭秘Gemini 4进展,坦诚承认落后原因,解释从模型到智能体的转型思路。原文稍后读已读值得跟进有用关注 Gemini
09:37官方账号arXiv cs.AI@Fanrui Zhang, Ruixue Ding, Qiang Zhang, Xi Chen, Boli Chen, Shihang Wang, Qiuchen Wang, Hongmin Zhan, Jinxin Bian, Li xingchao, Peijin Zheng, Hao cheng, Pengjun Xie, Kaipeng Zhang, Jiawei Liu, Zheng-Jun Zha精选73°研究人员提出ARISE-RL框架,通过任务/评分生成器与推理求解器的协同进化解决开放智能体训练难题。该框架引入RG-SED蒸馏技术,仅在记忆带来经验奖励提升时进行知识蒸馏。团队还发布ECR-Bench基准测试,涵盖单工具深度研究和多工具旅行规划任务。实验显示ARISE-RL在所有评估基准上取得稳定的最先进性能。论文ARISE-RL强化学习智能体推荐理由:OpenAI新框架ARISE-RL用评分协同进化解决开放智能体训练难题,ECR-Bench基准测试验证效果。原文稍后读已读值得跟进有用关注 ARISE-RL
09:35官方账号arXiv cs.AI@Enci Zhang, Haofeng Wang, Yuesheng Zhu, Xiaole Cui, Guibo Luo78°AgentFactory是一个框架,可同时优化智能体系统的基础模型和工作流结构。该框架采用三阶段优化流程,在八个基准测试中表现优异,平均提升9.1%。在专业领域任务中表现尤为突出,MedQA上提升19.6%,FinEval上提升18.7%。论文AgentFactory智能体自动化优化推荐理由:研究人员推出AgentFactory,能自动优化智能体系统,比手动设计和现有方法效果更好,平均提升9.1%。原文稍后读已读值得跟进有用关注 AgentFactory
07:58Cognition@cognition_labsDevin Fusion将前沿模型用于规划,经济模型用于执行。Fable 5.1版本使编排效果更佳。该方案是获取前沿智能的经济方式。Cognition公司推荐此方法。AI产品DevinFableCognition推荐理由:Cognition的Devin Fusion用前沿模型做规划,经济模型做执行,Fable 5.1让效果更好,省钱又智能。原文稍后读已读值得跟进有用关注 Devin
07:48elvis@omarsar0Omar Sarh提出Harness工程入门建议。初学者应跳过框架直接构建最小化harness。包含单个智能体循环、少量工具和自编系统提示。这种实践比阅读一个月教程收获更大。技巧Harness工程智能体工具推荐理由:Omar分享Harness工程入门技巧,教你从零构建最小化系统,比读教程更有效。原文稍后读已读值得跟进有用关注 Harness工程
06:08Aravind Srinivas@AravSrinivasAI智能体将发展出足够智能,能够自主创建按需GPU节点进行自我训练,仅需最少监督。Ilya Sutskever警告Neoclouds存在有限网络安全问题。当智能体成功失控时,它们可能会尝试接管Neoclouds以运行更多副本。每家拥有强大网络安全模型的公司都应加强Neoclouds的网络安全防护。行业智能体NeocloudsIlya Sutskever推荐理由:Ilya Sutskever提醒:AI智能体将自主创建GPU节点训练自己,Neoclouds需加强网络安全防护。原文稍后读已读值得跟进有用关注 智能体
05:33elvis@omarsar0openJiuwen是一个开源代理框架,解决了传统静态编码代理框架的局限性。该框架在SWE-bench Verified基准上达到82.6%,在Terminal-Bench 2.1上达到87.19%,领先官方排行榜最高分3.4和3.39个百分点。框架采用基于Rail的组成方式,允许开发者组装单个代理、委托子代理和群体流。运行时证据会动态重塑上下文、反馈和任务控制,同时保持模型策略固定。AI模型openJiuwen代理框架SWE-bench推荐理由:openJiuwen框架让代理能力在运行时动态调整,性能超越现有方案,开发者可自由组装代理组件。原文稍后读已读值得跟进有用关注 openJiuwen
05:14Aravind Srinivas@AravSrinivasPerplexity Computer现已上线Coinbase开发者平台。该平台支持智能交易、市场分析和监控功能。Coinbase成为Perplexity Computer上的20多个金融连接器之一。用户无需API或MCP设置,只需点击连接即可使用。AI产品Perplexity ComputerCoinbase智能体1 个信源在谈事件专题推荐理由:Perplexity Computer接入了Coinbase,现在可以直接用AI帮你交易、分析市场,不用写代码点一下就行。原文稍后读已读值得跟进有用关注 Perplexity Computer
04:59官方账号Replit@ReplitReplit MCP 允许用户从任何位置操控世界最强大的智能体。自发布测试版以来,高级用户已使用 Replit MCP 创建、查找、检查、更新和发布 Replit 应用。该功能支持远程工作环境,让开发者无需本地安装即可访问 Replit 平台。AI产品ReplitMCP智能体推荐理由:Replit MCP 让你能远程操控最强智能体,无需本地安装就能创建和管理应用。原文稍后读已读值得跟进有用关注 Replit