03:22Philipp Schmid@_philschmidGemini 3.8 Flash在@cursor_ai基准测试中取得了69.9%的成绩,每任务成本为2.38美元。该模型在性能与成本之间实现了平衡。测试结果显示其具有竞争力。AI模型GeminiCursor基准测试1 个信源在谈事件专题推荐理由:谷歌Gemini 3.8 Flash在Cursor测试中得分69.9%,每任务仅2.38美元,性价比突出。原文稍后读已读值得跟进有用关注 Gemini
03:17官方账号Cursor@cursor_aiCursor编辑器现已集成Gemini 3.8 Flash模型。这款轻量级模型专为快速响应设计。用户可在Cursor中直接使用该模型进行代码编写和调试。Gemini 3.8 Flash在多项基准测试中表现出色。AI产品GeminiCursor3.8 Flash3 个信源在谈事件专题推荐理由:Cursor新上线Gemini 3.8 Flash,比前代响应更快,代码生成能力更强。原文稍后读已读值得跟进有用关注 Gemini
03:03Browser Use@browser_useBrowser Use Cloud平台允许用户同步本地Chrome cookies到云端。该认证方式无需向智能体提供密码。用户可在生产环境中保持登录状态。该服务已在Browser Use Cloud平台上线。AI产品Browser UseChrome cookies认证推荐理由:Browser Use Cloud推出cookie同步功能,无需密码即可保持登录,比传统认证更安全便捷。原文稍后读已读值得跟进有用关注 Browser Use
03:02Augment Code@augmentcodeAugmentCode发布新平台,用户可通过输入三句话完成智能体配置。第一句构建自动化流程,第二句修复问题,第三句查询成本。该平台无需点击操作,简化了智能体搭建过程。用户可通过cosmos.augmentcode.com体验此功能。AI产品AugmentCode智能体自动化推荐理由:AugmentCode用三句话搞定智能体配置,告别繁琐点击操作,自然语言直接搞定自动化搭建、修复和成本查询。原文稍后读已读值得跟进有用关注 AugmentCode
03:02Augment Code@augmentcodeCosmos Advisor 推出新型智能体平台,用户只需一个提示框即可完成软件开发任务。该平台无需学习复杂操作,直接回答用户问题。用户可使用此平台构建和修复软件,实现整个软件工厂功能。AI产品Cosmos Advisor智能体软件工厂推荐理由:Cosmos Advisor 发布新平台,一个提示框搞定软件开发,不用学平台直接用。原文稍后读已读值得跟进有用关注 Cosmos Advisor
02:49elvis@omarsar0Exo harness通过向模型暴露完整代码和日志实现递归自我改进。其设计哲学最大化遵循bitter lesson原则,允许动态升级。Exo在价格/性能比上表现突出,提供完整运行代码而非仅提示词。AI产品ExoDAIR递归自我改进推荐理由:DAIR发布的Exo harness让模型能直接访问和改进自身代码,实现真正的递归自我提升。原文稍后读已读值得跟进有用关注 Exo
02:48elvis@omarsar0Guanlan Dai 发布 FrontierHarness Eval,对 Pi、Exo、Claude Code、Codex、DeepSeek Harness 等 9 个模型进行评测。评测包含 360 次运行和 20 亿 token 的处理。通过率从 50% 到 67% 不等,单次通过成本从 1.05 美元到 18.34 美元。AI模型FrontierHarness EvalPiExo推荐理由:Guanlan 测了 9 个模型,通过率差 17%,成本差 17 倍,帮你选最划算的。原文稍后读已读值得跟进有用关注 FrontierHarness Eval
02:43Gary Marcus@GaryMarcus73°William Tunstall-Pedoe提出神经符号AI概念,结合不可靠但能力强的机器学习与可靠但能力较弱的确定性软件。这种结合方式旨在取两者之长,解决当前AI系统的可靠性问题。该观点由英国皇家工程院院士William Tunstall-Pedoe在Substack文章中详细阐述。AI模型神经符号AIWilliam Tunstall-Pedoe机器学习推荐理由:Gary Marcus转推的神经符号AI概念,解释如何结合ML与确定性软件优势。原文稍后读已读值得跟进有用关注 神经符号AI
02:34Justine Moore@venturetwins用户使用名为@attentioninc的AI助手在几秒钟内找到了Reddit评论。该AI助手能够记录用户屏幕并帮助搜索内容。用户表示Reddit和Google搜索都未能找到这条评论。AI产品@attentionincAI助手智能体推荐理由:@attentioninc这个AI助手能帮你快速找到网上内容,比Google和Reddit搜索还快。原文稍后读已读值得跟进有用关注 @attentioninc
02:34The Rundown AI@therundownai78°美国商务部长Howard Lutnick向Axios表示信任Anthropic公司,称其已按要求行事并回到正确轨道。此前,美国商务部曾对Fable和Mythos实施出口管制,五角大楼也将Anthropic列为供应链风险。这一表态标志着美国政府对Anthropic的态度发生转变。行业AnthropicHoward Lutnick出口管制10 个信源在谈事件专题推荐理由:美国商务部长突然力挺Anthropic,这家曾被五角大楼列为风险的公司现在被政府信任了。原文稍后读已读值得跟进有用关注 Anthropic
02:07官方账号Demis Hassabis@demishassabis73°谷歌在不到一个月内再次升级Gemini模型,推出3.8 Flash版本。这是Gemini系列中第三个Flash模型更新,仅六周内完成。新3.8 Flash Cyber版本专注于网络安全领域,提升了防御能力。该模型在智能体和编程能力方面有显著提升。AI模型GeminiGemini 3.8 Flash网络安全10 个信源在谈事件专题推荐理由:谷歌六周内第三次更新Flash模型,这次专门针对网络安全,编程能力更强。原文稍后读已读值得跟进有用关注 Gemini
02:05Gary Marcus@GaryMarcusGary Marcus公开质疑The Information关于Astra模型的报道准确性。报道称Astra采用了一种创新技术提升模型性能,但也导致模型"思考过程"更难被理解。Marcus要求媒体澄清或更正这一说法。The Information编辑Stephanie Palazzolo表示报道存在更多细节需要解释。行业AstraGary MarcusThe Information1 个信源在谈事件专题推荐理由:Gary Marcus再次质疑Astra报道准确性,AI领域专家与媒体的认知差异值得关注。原文稍后读已读值得跟进有用关注 Astra
02:04Anton Osika@antonosikaLovable公司推出Slack集成功能,用户可通过@Lovable指令执行任务。该功能可读取笔记、跨连接器工作、批量发送消息并编辑关键应用。Lovable应用被视为企业的"事实真相来源",提供直观界面。AI产品LovableSlack智能体6 个信源在谈事件专题推荐理由:Lovable在Slack里添加了@功能,能帮你自动建应用、改代码、查数据,比手动操作快多了。原文稍后读已读值得跟进有用关注 Lovable
02:02官方账号Google AI@GoogleAI73°Google 发布 Gemini 3.8 Flash Cyber 模型,专为安全团队设计。该模型能自动生成可靠的安全补丁,性能比顶级商业模型高 2.6 倍。Google 已使用该模型保护自身代码,并通过 Fairwind Program 向政府机构和关键基础设施运营商提供优先访问。AI产品GeminiGemini 3.8 Flash CyberGoogleAI推荐理由:Google 新出的安全模型 Gemini 3.8 Flash Cyber 能自动生成高质量补丁,比商业模型强 2.6 倍还便宜。原文稍后读已读值得跟进有用关注 Gemini
01:42Firecrawl@firecrawl_devFireCrawl 公司开源了 DevDex 基准测试,用于评估搜索工具帮助编程代理找到正确源代码的可靠性。该基准测试专门针对编程代理的搜索需求设计。DevDex 基准测试已在 firecrawl.dev/benchmarks/dev 页面发布。AI模型DevDexFireCrawl编程代理推荐理由:FireCrawl 推出 DevDex 基准,帮你选对编程代理的搜索工具原文稍后读已读值得跟进有用关注 DevDex
01:39Rowan Cheung@rowancheung用户分享了日常使用的AI集成产品,包括Notion AI、Spotify的AI DJ功能、Whoop和Slack的Slackbot。同时列出了失败的AI产品,如Instagram的Meta AI、Apple Intelligence、DoorDash的AI聊天功能和Google Meet的会议笔记功能。用户通过实际使用体验区分了成功和失败的AI产品集成。AI产品Notion AISpotifySlack9 个信源在谈事件专题推荐理由:Rowan Cheung分享了他日常使用的AI产品,哪些好用哪些不好用,帮你避开AI产品的坑。原文稍后读已读值得跟进有用关注 Notion AI
01:38Harrison Chase@hwchase17LangChain将于9月24日在纽约举办Interrupt大会,邀请了多位AI领域重要人物。OpenRouter创始人Alex Atallah将分享模型选择与创新路由技术。Modal创始人Bernhardsson将介绍其模型推理层与沙盒环境。Rogo创始人Gabe Stengel将展示AI在金融领域的应用案例。行业LangChainOpenRouterModal推荐理由:LangChain大会请到了OpenRouter、Modal和Rogo创始人,聊聊AI智能体栈的最新实践。原文稍后读已读值得跟进有用关注 LangChain
01:37lmarena.ai@lmarena_ai73°Anthropic的Fable 5.1 (Max)在Code Arena: WebDev基准测试中以1765分排名第一,领先第二名Qwen3.8-Max-0902达77分。相比前代Fable 5 (Max)排名第八,新版本提升了137分。Fable 5.1 (Max)每百万代币成本为40美元,在高价区间重新定义了性能边界。AI模型Fable 5.1AnthropicCode Arena10 个信源在谈事件专题推荐理由:Anthropic新发布的Fable 5.1 Max在代码基准测试中大幅领先,比第二名高出77分,刷新了高价模型性能标准。原文稍后读已读值得跟进有用关注 Fable 5.1
01:36lmarena.ai@lmarena_aiArena平台上线了Agent、WebDev和Text三个竞技场排行榜。Agent竞技场测试AI代理的综合能力,WebDev竞技场评估网页开发技能,Text竞技场专注文本处理能力。用户可通过arena.ai网站查看各排行榜的详细数据和排名情况。AI产品ArenaAI竞技场排行榜推荐理由:Arena新推三个专业竞技场,分别测试AI代理、网页开发和文本处理能力,帮你直观了解AI模型表现差异。原文稍后读已读值得跟进有用关注 Arena
01:36小互@imxiaohuClaude 官方文档近日更新,新增了平台使用指南。文档地址为 platform.claude.com/docs/en/build-。文档内容涵盖了 Claude 平台的核心功能和使用方法。AI产品Claude官方文档AI平台推荐理由:Claude 更新了官方文档,开发者可以查看最新平台功能和使用指南。原文稍后读已读值得跟进有用关注 Claude
01:36Lenny Rachitsky@lennysan73°OpenAI产品负责人Tara Seshan解释ChatGPT Work与Codex实际是同一产品。OpenAI内部文化强调'主渠道'理念,即产品是否被用户全天候依赖。Codex团队正构建前沿模型,关注2-3个月后的能力而非当前或一年后。知识工作的未来方向是引导而非执行。行业ChatGPTCodexOpenAI10 个信源在谈事件专题推荐理由:OpenAI产品经理揭秘ChatGPT Work与Codex关系,分享内部产品开发理念。原文稍后读已读值得跟进有用关注 ChatGPT
01:35Patrick Loeber@patloeber73°Google 发布 Gemini 3.8 Flash 模型,在智能体和编程能力方面相比 3.7 Flash 有显著改进。新模型保持与 3.7 Flash 相同的价格点。Gemini 3.8 Flash 专注于提升代码生成和执行能力。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google 推出 Gemini 3.8 Flash,价格不变但智能体和编程能力更强了。原文稍后读已读值得跟进有用关注 Gemini
01:35AI SDK@aisdk73°Google发布了Gemini 3.8,这是其最新的推理和编码模型。该模型基于三周前发布的3.7 Flash版本,利用长时间运行的智能体循环技术。新版本包含两个变体:Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。AI产品GeminiGemini 3.8 FlashAI SDK10 个信源在谈事件专题推荐理由:Google刚推出Gemini 3.8 Flash,比三周前的3.7 Flash更强,现在可以用AI SDK直接调用。原文稍后读已读值得跟进有用关注 Gemini
01:34Augment Code@augmentcodeIgor Ostrovsky分析了Cloudflare、Vercel、Uber等公司构建的软件工厂模式。这些工厂已取得初步成果,展示了自动化软件开发流程的潜力。文章探讨了软件工厂当前的工作方式和未来发展趋势。行业软件工厂Igor OstrovskyCloudflare推荐理由:Igor Ostrovsky解读软件工厂现状,探讨AI代理是否会反向提示人类开发者。原文稍后读已读值得跟进有用关注 软件工厂
01:33Jerry Liu@jerryjliu0Imaan Sultan 宣布加入 Llama Index,负责增长营销、品牌和社区工作。Llama Index 解决企业数据结构化问题,已处理数十亿页文档。该公司的技术持续在基准测试中名列前茅。行业Llama IndexImaan Sultan企业数据推荐理由:Llama Index 迎来新增长负责人,他们让开发者、企业能更好利用非结构化数据。原文稍后读已读值得跟进有用关注 Llama Index
01:33Y Combinator@ycombinator73°ConveoAI是一家S24加速器公司,近日完成5000万美元A轮融资。其AI面试工具可进行深度视频对话,帮助品牌在几天内完成过去需要数月的研究工作。已有400多家企业使用该产品,包括谷歌、联合利华和Canva等50多家财富500强品牌。行业ConveoAI消费者研究AI面试推荐理由:ConveoAI获5000万美元融资,AI面试工具让品牌调研从数月缩短到几天,已服务50多家财富500强企业。原文稍后读已读值得跟进有用关注 ConveoAI
01:33Varun Mohan@_mohansoloGemini 3.8 Flash已正式发布,相比3.7 Flash版本在智能体编程和通用知识工作方面有显著提升。该模型已在内部团队中使用并获得良好反馈。现在所有用户都可以通过Antigravity平台访问这一新版本。AI模型GeminiGemini 3.8 FlashAntigravity10 个信源在谈事件专题推荐理由:Google发布了Gemini 3.8 Flash,在编程和知识工作上比前代更强,现在人人都能用。原文稍后读已读值得跟进有用关注 Gemini
01:12OpenRouter@OpenRouterAIGemini 3.8 Flash新增智能体视频处理功能。用户可在视频部分设置processing参数为"agentic"。模型能自主导航时间轴,而非以固定速率采样每一帧。该功能也适用于早期Gemini Flash模型。AI产品Gemini 3.8 FlashOpenRouter智能体10 个信源在谈事件专题推荐理由:OpenRouter宣布Gemini 3.8 Flash支持智能体视频处理,能自主导航时间轴,比固定帧采样更高效。原文稍后读已读值得跟进有用关注 Gemini 3.8 Flash
00:51Sundar Pichai@sundarpichai73°谷歌推出3.8 Flash模型,这是六周内的第三个Flash版本。该模型在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。在DeepSWE v1.1基准测试中,3.8 Flash以更低成本自主解决复杂工程问题,性能超越大多数更大的前沿模型。AI模型3.8 FlashFlash模型谷歌推荐理由:谷歌六周内第三次发布Flash模型,3.8版本在工程任务和推理能力上大幅提升,成本却更低。原文稍后读已读值得跟进有用关注 3.8 Flash
00:50Sundar Pichai@sundarpichai73°3.8 Flash Cyber 在真实 Chrome 安全漏洞评估中,比更大模型多产生 2.6 倍的正确补丁。Google 通过 Fairwind 计划向政府机构和网络安全合作伙伴提供该模型访问权限。该模型在真实世界用例中展现出超越基准测试的能力。AI模型3.8 Flash CyberGoogleCybersecurity推荐理由:Google 发布的 3.8 Flash Cyber 模型在真实安全漏洞修复上比大模型强 2.6 倍,现在政府机构也能用上了。原文稍后读已读值得跟进有用关注 3.8 Flash Cyber
00:47elvis@omarsar0Meta推出的Harness-of-Harness系统在GameCraft-Bench、FrontierSWE和ProgramBench三个基准测试中,与三种不同的harness和模型配对相比,经过三次迭代后平均提升52.25%,最高达82.86%。该系统通过将执行组织为规划、编码和测试的重复增量,平衡修复与能力增长,将工作范围限定为可验证的小步骤。系统保持实现时测试与独立评估分离,约束输出而非工作流程。AI产品Harness-of-HarnessMeta编程助手推荐理由:Meta新出的Harness-of-Harness能让编程代理连续工作数天,比独立系统平均提升52%,最高82%原文稍后读已读值得跟进有用关注 Harness-of-Harness
00:46elvis@omarsar073°Google DeepMind推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型。Gemini 3.8 Flash在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。Gemini 3.8 Flash Cyber是谷歌最强大的网络安全模型,具备前沿级别的漏洞检测和自动修补能力。两款模型均位于帕累托前沿,性能表现优异。AI模型GeminiGemini 3.8 FlashGoogle DeepMind10 个信源在谈事件专题推荐理由:谷歌发布Gemini 3.8 Flash系列,新增网络安全版本,在漏洞检测和修补方面表现突出。原文稍后读已读值得跟进有用关注 Gemini
00:46官方账号Google DeepMind@GoogleDeepMind谷歌DeepMind发布Fairwind计划,向政府和合作伙伴提供Gemini 3.8 Flash模型。该模型已通过@Antigravity平台上线,并通过@GoogleAIStudio和@AndroidStudio API开放访问。Google AI Pro和Ultra订阅用户可在@GeminiApp和Google搜索AI模式中使用3.8 Flash版本。行业Gemini 3.8 FlashGoogleDeepMindFairwind10 个信源在谈事件专题推荐理由:谷歌给政府和合作伙伴提供Gemini 3.8 Flash保护关键基础设施,比普通用户更早用上新模型。原文稍后读已读值得跟进有用关注 Gemini 3.8 Flash
00:45官方账号LangChain@LangChainAIOpenWiki 新增与 Cursor 编辑器的集成。用户可通过两个命令完成安装:npm install -g openwiki @latest 和 openwiki integrations install cursor。此次集成使 OpenWiki 更易于通过编程代理工具访问。OpenWiki 已支持 Claude、Codex、OpenCode 和 Cursor 多种工具集成。AI产品OpenWikiCursor编程助手2 个信源在谈事件专题推荐理由:OpenWiki 接入了 Cursor 编辑器,两条命令就能搞定,比之前更方便了。原文稍后读已读值得跟进有用关注 OpenWiki
00:45官方账号Google DeepMind@GoogleDeepMind谷歌推出Gemini 3.8 Flash模型,在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。同时发布Gemini 3.8 Flash Cyber模型,具备前沿级漏洞检测和自动修补能力。这两个新模型旨在帮助扩展AI代理并保障代码安全。AI模型Gemini3.8 Flash3.8 Flash Cyber推荐理由:谷歌发布了Gemini 3.8系列模型,一个提升推理能力,一个专注网络安全,都是各自领域的升级款。原文稍后读已读值得跟进有用关注 Gemini
00:40Paul Couvert@itsPaulAi73°Google发布Gemini 3.8 Flash模型,距离3.7 Flash仅20天。新版本性能与Opus 5和GPT-5.6 Sol相当,但价格仅为前者的1/6和1/5。Google称这是其迄今为止最好的推理和编码模型,包含两个新变体:Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google刚发布Gemini 3.8 Flash,性能媲美顶级模型但价格便宜5-6倍,彻底改变了Flash模型的定位。原文稍后读已读值得跟进有用关注 Gemini
00:40小互@imxiaohu73°Claude Fable 5.1 更擅长长时间执行复杂任务,官方发布 16 条提示词建议。新模型在 high 算力档位表现最佳,medium 可平替上一代且更便宜,low 甚至能抗衡 Opus/Sonnet。代码执行时应提示工具一次性并发调用,避免单步低效操作。复杂任务需防半途停顿,可设置非破坏性操作直接执行规则。技巧Claude Fable 5.1提示词工程智能体7 个信源在谈事件专题推荐理由:Fable 5.1 发布实用提示指南,教你解决复杂任务执行、工具并发和上下文管理等痛点原文稍后读已读值得跟进有用关注 Claude Fable 5.1
00:33Jerry Liu@jerryjliu0Fable 5.1在ParseBench基准测试中表现优于前代Fable 5。ParseBench包含2000多份来自金融、法律、保险等领域的真实世界文档。Fable 5.1在表格忠实度、内容忠实度、格式、图表和视觉定位等指标上全面领先。它是近期少数在文档OCR性能上实现模型代际提升的前沿模型之一。AI模型FableFable 5.1ParseBench推荐理由:Fable 5.1在文档解析任务上超越前代,但单独使用成本较高,每页15美分,比LlamaParse贵10-15倍。原文稍后读已读值得跟进有用关注 Fable
00:33lmarena.ai@lmarena_ai78°Gemini 3.8 Flash (High)在Agent Arena排名第14,较3.7版本提升5.94个百分点。在Text Arena中位列第7,超越Claude Opus 5 (High)的1492分。该模型在写作、多轮对话和长查询等类别中排名显著提升。AI模型Gemini 3.8 FlashGoogleDeepMindClaude Opus 510 个信源在谈事件专题推荐理由:GoogleDeepMind发布Gemini 3.8 Flash (High),在多个基准测试中超越前代版本和Claude Opus 5。原文稍后读已读值得跟进有用关注 Gemini 3.8 Flash
00:28官方账号Logan Kilpatrick@OfficialLoganK73°Google推出Gemini 3.8 Flash模型,这是6周内第三个更新的Flash版本。该模型在智能体和编程能力方面有明显提升。Gemini 3.8 Flash是Google快速迭代的产品线之一。AI模型GeminiGemini 3.8 Flash智能体10 个信源在谈事件专题推荐理由:Google发布Gemini 3.8 Flash,6周内第三次更新Flash模型,智能体和编程能力又有提升。原文稍后读已读值得跟进有用关注 Gemini