01:35Patrick Loeber@patloeber73°Google 发布 Gemini 3.8 Flash 模型,在智能体和编程能力方面相比 3.7 Flash 有显著改进。新模型保持与 3.7 Flash 相同的价格点。Gemini 3.8 Flash 专注于提升代码生成和执行能力。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google 推出 Gemini 3.8 Flash,价格不变但智能体和编程能力更强了。原文稍后读已读值得跟进有用关注 Gemini
01:33Varun Mohan@_mohansoloGemini 3.8 Flash已正式发布,相比3.7 Flash版本在智能体编程和通用知识工作方面有显著提升。该模型已在内部团队中使用并获得良好反馈。现在所有用户都可以通过Antigravity平台访问这一新版本。AI模型GeminiGemini 3.8 FlashAntigravity10 个信源在谈事件专题推荐理由:Google发布了Gemini 3.8 Flash,在编程和知识工作上比前代更强,现在人人都能用。原文稍后读已读值得跟进有用关注 Gemini
01:13官方账号Decoder@Matthias BastianGoogle在六周内发布第三款Flash模型Gemini 3.8 Flash。该模型在部分智能体编程基准测试中与Claude Opus 5表现相当但成本更低。然而其推理过程消耗约30%更多输出token,实际使用成本高于前代模型。AI模型GeminiClaude Opus 5Google推荐理由:Google六周连推三款经济模型,Gemini 3.8 Flash虽成本低但推理消耗高。原文稍后读已读值得跟进有用关注 Gemini
00:51Sundar Pichai@sundarpichai73°谷歌推出3.8 Flash模型,这是六周内的第三个Flash版本。该模型在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。在DeepSWE v1.1基准测试中,3.8 Flash以更低成本自主解决复杂工程问题,性能超越大多数更大的前沿模型。AI模型3.8 FlashFlash模型谷歌推荐理由:谷歌六周内第三次发布Flash模型,3.8版本在工程任务和推理能力上大幅提升,成本却更低。原文稍后读已读值得跟进有用关注 3.8 Flash
00:50Sundar Pichai@sundarpichai73°3.8 Flash Cyber 在真实 Chrome 安全漏洞评估中,比更大模型多产生 2.6 倍的正确补丁。Google 通过 Fairwind 计划向政府机构和网络安全合作伙伴提供该模型访问权限。该模型在真实世界用例中展现出超越基准测试的能力。AI模型3.8 Flash CyberGoogleCybersecurity推荐理由:Google 发布的 3.8 Flash Cyber 模型在真实安全漏洞修复上比大模型强 2.6 倍,现在政府机构也能用上了。原文稍后读已读值得跟进有用关注 3.8 Flash Cyber
00:46elvis@omarsar073°Google DeepMind推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型。Gemini 3.8 Flash在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。Gemini 3.8 Flash Cyber是谷歌最强大的网络安全模型,具备前沿级别的漏洞检测和自动修补能力。两款模型均位于帕累托前沿,性能表现优异。AI模型GeminiGemini 3.8 FlashGoogle DeepMind10 个信源在谈事件专题推荐理由:谷歌发布Gemini 3.8 Flash系列,新增网络安全版本,在漏洞检测和修补方面表现突出。原文稍后读已读值得跟进有用关注 Gemini
00:45官方账号Google DeepMind@GoogleDeepMind谷歌推出Gemini 3.8 Flash模型,在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。同时发布Gemini 3.8 Flash Cyber模型,具备前沿级漏洞检测和自动修补能力。这两个新模型旨在帮助扩展AI代理并保障代码安全。AI模型Gemini3.8 Flash3.8 Flash Cyber推荐理由:谷歌发布了Gemini 3.8系列模型,一个提升推理能力,一个专注网络安全,都是各自领域的升级款。原文稍后读已读值得跟进有用关注 Gemini
00:40Paul Couvert@itsPaulAi73°Google发布Gemini 3.8 Flash模型,距离3.7 Flash仅20天。新版本性能与Opus 5和GPT-5.6 Sol相当,但价格仅为前者的1/6和1/5。Google称这是其迄今为止最好的推理和编码模型,包含两个新变体:Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google刚发布Gemini 3.8 Flash,性能媲美顶级模型但价格便宜5-6倍,彻底改变了Flash模型的定位。原文稍后读已读值得跟进有用关注 Gemini
00:33Jerry Liu@jerryjliu0Fable 5.1在ParseBench基准测试中表现优于前代Fable 5。ParseBench包含2000多份来自金融、法律、保险等领域的真实世界文档。Fable 5.1在表格忠实度、内容忠实度、格式、图表和视觉定位等指标上全面领先。它是近期少数在文档OCR性能上实现模型代际提升的前沿模型之一。AI模型FableFable 5.1ParseBench推荐理由:Fable 5.1在文档解析任务上超越前代,但单独使用成本较高,每页15美分,比LlamaParse贵10-15倍。原文稍后读已读值得跟进有用关注 Fable
00:33lmarena.ai@lmarena_ai78°Gemini 3.8 Flash (High)在Agent Arena排名第14,较3.7版本提升5.94个百分点。在Text Arena中位列第7,超越Claude Opus 5 (High)的1492分。该模型在写作、多轮对话和长查询等类别中排名显著提升。AI模型Gemini 3.8 FlashGoogleDeepMindClaude Opus 510 个信源在谈事件专题推荐理由:GoogleDeepMind发布Gemini 3.8 Flash (High),在多个基准测试中超越前代版本和Claude Opus 5。原文稍后读已读值得跟进有用关注 Gemini 3.8 Flash
00:28官方账号Logan Kilpatrick@OfficialLoganK73°Google推出Gemini 3.8 Flash模型,这是6周内第三个更新的Flash版本。该模型在智能体和编程能力方面有明显提升。Gemini 3.8 Flash是Google快速迭代的产品线之一。AI模型GeminiGemini 3.8 Flash智能体10 个信源在谈事件专题推荐理由:Google发布Gemini 3.8 Flash,6周内第三次更新Flash模型,智能体和编程能力又有提升。原文稍后读已读值得跟进有用关注 Gemini
00:28官方账号Logan Kilpatrick@OfficialLoganKGoogle发布Gemini 3.8 Flash模型,价格与3.7版本相同,速度基本一致。该模型现已通过Gemini API、AI Studio、Antigravity和Gemini App等多渠道提供。Google团队正努力推动AI技术前沿发展。AI模型Gemini3.8 FlashGoogle推荐理由:Google新发布的3.8 Flash模型价格不变,速度相当,多平台可用,性价比提升。原文稍后读已读值得跟进有用关注 Gemini
00:17IT之家(博客/媒体)78°谷歌发布Gemini 3.8 Flash Cyber模型,在CyberGym基准测试中展现顶尖自主漏洞挖掘能力。该模型在涵盖20种编程语言的复杂代码工程中,漏洞挖掘成功率突破70%。在CWE-Bench测试中,其首选正确率达47.2%,同时调用成本显著更低。谷歌内部已全面部署此模型用于代码安全防护。AI模型GeminiGemini 3.8 Flash Cyber谷歌推荐理由:谷歌新发布的Gemini 3.8 Flash Cyber专门用于代码安全防护,漏洞挖掘成功率超70%,修复漏洞效率是顶尖商业模型的2.6倍。原文稍后读已读值得跟进有用关注 Gemini
00:17OpenRouter@OpenRouterAI78°Gemini 3.8 Flash已在OpenRouter平台上线。该模型以3.7 Flash的 introductory 价格提供。在编码、金融、法律、视频和科学基准测试中均超越前代版本。用户可通过 openrouter.ai/google/gemini- 访问使用。AI模型GeminiGoogleDeepMindOpenRouter推荐理由:GoogleDeepMind刚发布的Gemini 3.8 Flash价格不变但性能全面超越前代,覆盖多个专业领域基准。原文稍后读已读值得跟进有用关注 Gemini
00:15Philipp Schmid@_philschmid73°Google在6周内发布第三个Flash版本,专注于实际工程、长期任务和智能体自主性。Gemini 3.8 Flash在所有领域表现均优于3.7 Flash版本,定价为每100万token 0.75美元/3.75美元。该模型采用更小步骤并更频繁验证工作,虽然会增加token使用量,但能有效提高复杂和长期目标的工作质量。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google发布Gemini 3.8 Flash,比前代表现更好,特别适合复杂编程和智能体任务。原文稍后读已读值得跟进有用关注 Gemini
00:14Google Gemini App@GeminiApp73°Google今日发布Gemini 3.8 Flash模型,Pro和Ultra用户可使用。该模型针对日常话题提供可靠全面的建议,并支持文本分析和复杂编码等深度任务。Gemini 3.8 Flash在响应质量和实用性方面有所提升。AI模型GeminiGemini 3.8 FlashGoogle10 个信源在谈事件专题推荐理由:Google发布了Gemini 3.8 Flash,Pro和Ultra用户现在可以用它做文本分析和复杂编程了。原文稍后读已读值得跟进有用关注 Gemini
00:13OpenRouter@OpenRouterAIMiniMax H3 Max 是最新发布的模型,在多个基准测试中表现出色。该模型通过 OpenRouter 平台提供,开发者可以快速接入使用。MiniMax H3 Max 在处理复杂任务时展现出强大的性能。AI模型MiniMaxH3 MaxOpenRouter1 个信源在谈事件专题推荐理由:MiniMax 发布了 H3 Max 模型,在 OpenRouter 上就能用,性能比前代有明显提升。原文稍后读已读值得跟进有用关注 MiniMax
00:13OpenRouter@OpenRouterAIMiniMax H3 Max 模型已在 OpenRouter 平台上线,速度比 H3 快 7 倍,响应时间从 3.5 分钟缩短至约 30 秒。价格方面,H3 Max 每段文本处理费用为 0.4 美元,比 H3 的 0.65 美元更经济实惠。AI模型MiniMaxH3 MaxOpenRouter1 个信源在谈事件专题推荐理由:MiniMax 推出了比 H3 更快更便宜的 H3 Max,在 OpenRouter 上就能用。原文稍后读已读值得跟进有用关注 MiniMax
00:08官方账号Google AI@GoogleAI73°谷歌推出Gemini 3.8 Flash模型,专为处理复杂智能体和多步骤任务设计。该模型在推理能力方面有显著提升,不仅能编写代码还能导航复杂项目。Gemini 3.8 Flash结合原生视频理解和高级编程功能,可自主构建3D游戏、测试并修复错误。模型配备了努力控制机制,确保思考量与消耗的token成正比。AI模型GeminiGemini 3.8 Flash智能体10 个信源在谈事件专题推荐理由:谷歌新发布的Gemini 3.8 Flash能自主完成复杂项目,比前代模型推理能力更强,还支持视频理解与编程的智能体循环。原文稍后读已读值得跟进有用关注 Gemini
00:08Google AI Developers@googleaidevsGoogle 发布了 Gemini 3.8 Flash 模型,该模型专为复杂推理任务设计。研究人员使用该模型与 ThreeJS 在 Google AI Studio 中构建了交互式 3D 可视化工具。该模型能够生成硬件设备逼真的、符合物理比例的拆解视图,并自动将设备分解为可展开检查的层次结构。用户可以通过拆解滑块交互式地探索设备内部结构。AI模型Gemini 3.8 FlashThreeJSGoogleAIStudio10 个信源在谈事件专题推荐理由:Google 推出了 Gemini 3.8 Flash,能自动生成硬件设备的 3D 拆解视图,比普通模型更擅长复杂推理任务。原文稍后读已读值得跟进有用关注 Gemini 3.8 Flash
23:33IT之家(博客/媒体)精选73°谷歌在 Google DeepMind 网站上线了 Gemini 3.8 Flash 模型,基于 Gemini 3.7 Flash 开发。该模型拥有最高 1M token 上下文窗口和 64K token 文本输出能力。在编程、知识处理、多模态处理等基准测试中表现优异。模型面向个人用户、开发者和企业,适合软件工程和智能体任务场景。AI模型GeminiGemini 3.8 Flash谷歌10 个信源在谈事件专题推荐理由:谷歌新发布的 Gemini 3.8 Flash 模型,在软件工程和智能体任务方面有提升,支持自定义努力水平,适合大规模部署。原文稍后读已读值得跟进有用关注 Gemini
22:53官方账号Decoder@Maximilian Schreiner73°OpenAI将即将发布的Astra模型评为首个具备'关键'网络能力的系统。该公司计划通过监控思维链来控制该模型。然而,这种监控已被证明是模型真实决策的不可靠反映。据报告,Astra的新架构将更多思维过程推向不可读区域。随着能力提升,安全网可能正在变弱。AI模型AstraOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI的Astra模型被标记为最危险系统,新架构让监控变得更困难,安全与能力平衡面临挑战。原文稍后读已读值得跟进有用关注 Astra
20:53官方账号Decoder@Jonathan Kemper精选73°World Labs由AI研究员李飞飞联合创立,推出Atlas模型。该模型仅需几张照片即可生成、重建和模拟3D场景。Atlas在3D空间中锚定所有输入,而非处理为平面序列。公司称其性能超过专业模型。Atlas还能在模拟中生成机器人训练数据。AI模型AtlasWorld LabsFei-Fei Li推荐理由:李飞飞团队出的Atlas模型,几张照片就能生成3D世界,还能做机器人训练数据,比专业模型还强。原文稍后读已读值得跟进有用关注 Atlas
19:03爱范儿@郑廷旭李飞飞创立的 World Labs 发布了超梦系统,这是一个世界模型。该系统在多个基准测试中表现出色,能够模拟和预测物理世界的变化。超梦系统采用了最新的多模态技术,可以处理视觉、语言等多种输入数据。该系统在模拟复杂环境方面取得了显著进展。AI模型World Labs李飞飞超梦推荐理由:李飞飞团队的世界模型超梦系统来了,能模拟物理世界变化,比之前的模型更强大。原文稍后读已读值得跟进有用关注 World Labs
18:58AI Will@FinanceYF573°World Labs推出新世界模型Atlas,能从新角度重拍已有视频。原始画面仅由三部三脚架手机拍摄,Atlas可重建完整场景。该模型能从原本不存在的机位重新构图视频。视频生成技术正从修改画面转向理解三维空间。AI模型AtlasWorld Labs视频生成推荐理由:World Labs的Atlas模型能从新角度重拍视频,仅用三机位就能重建完整场景并生成新视角视频。原文稍后读已读值得跟进有用关注 Atlas
18:43AI Will@FinanceYF5精选73°Ox Alpha、DeepSeek V4 Flash、MiMo和GPT-5.6 Luna共同推动市场增长。这四款模型在近期表现突出,获得了市场关注。数据显示这些模型在各自领域展现出强劲竞争力。AI模型Ox AlphaDeepSeek V4 FlashMiMo2 个信源在谈事件专题推荐理由:看看这四款模型Ox Alpha、DeepSeek V4 Flash、MiMo和GPT-5.6 Luna如何推动市场增长原文稍后读已读值得跟进有用关注 Ox Alpha
18:38Hailuo AI@Hailuo_AI73°MiniMax团队将H3视频生成模型转化为世界模型,仅需8K样本和0.199%可训练参数。H3-World直接利用H3预训练的语言理解能力实现世界控制,无需新增动作模块。该模型在Hugging Face上已发布论文,展示了视频生成与理解的结合。AI模型H3H3-WorldMiniMax推荐理由:MiniMax用极少量参数把H3变成了世界模型,直接复用语言理解能力控制世界,太巧妙了。原文稍后读已读值得跟进有用关注 H3
16:29官方一手pandaily@contact@pandaily.com (Pandaily)精选73°科大讯飞全资子公司发布并开源了Spark X2.5-4B和X2.5-1.7B模型。这两款模型原生支持高达100万token的上下文长度。它们是首批支持如此长上下文的边缘模型。这些模型专为设备端AI设计。AI模型SparkX2.5-4BX2.5-1.7B推荐理由:科大讯飞开源了百万token上下文的边缘模型,比普通模型能处理更长文本,适合设备端部署。原文稍后读已读值得跟进有用关注 Spark
16:13爱范儿@莫崇宇李飞飞团队发布了全球首个多模态世界模型 Atlas。该模型仅需几张照片就能省去传统拍摄所需的数百个机位。Atlas 能够理解空间关系,为影视制作带来新可能。这一技术突破将改变内容创作方式。AI模型Atlas李飞飞多模态推荐理由:李飞飞团队新发布的 Atlas 模型,几张照片就能替代传统拍摄中的数百个机位,理解空间关系。原文稍后读已读值得跟进有用关注 Atlas
16:03orange.ai@oran_ge73°Fable 5.1 模型已发布,在相同 Token 下综合价格相比 Fable 5 降低约三分之一。实测显示,在 Max 模式下 Fable 5.1 的 Token 消耗量是 Fable 的 1.5 倍。该模型已上线 Cola 平台可供用户体验。AI模型FableFable 5.1Cola推荐理由:Fable 5.1 发布降价,但 Max 模式下消耗更多,明天 GPT6 或将到来,注意成本控制。原文稍后读已读值得跟进有用关注 Fable
15:58官方账号Latent Space (swyx)(博客/媒体)Anthropic 发布 Claude Fable/Mythos 5.1 模型,成为新的 SOTA 模型。该模型缓存价格降低 75%,同时输出 token 增加 70%。新模型在多个基准测试中表现优异,为用户提供更高性价比的选择。AI模型ClaudeFableMythos10 个信源在谈事件专题推荐理由:Anthropic 推出 Claude Fable/Mythos 5.1,价格大幅降低但输出能力提升,性价比超高。原文稍后读已读值得跟进有用关注 Claude
15:43量子位@量子位的朋友们73°阿里发布Qwen3.8-Max模型,在HumanEval编程基准上得分为84.5分,超越GPT-4o成为全球第一。该模型在代码生成、调试和优化方面表现优异,支持多种编程语言。Qwen3.8-Max还增强了多模态处理能力,能够理解和生成图文内容。AI模型Qwen3.8-Max阿里编程推荐理由:阿里Qwen3.8-Max编程能力登顶全球,代码生成超越GPT-4o,开发者必看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
15:03orange.ai@oran_geFable 5.1 模型将缓存价格降至原来的四分之一。在 Agent 环境中使用,综合成本可降低 25% 至 45%。此次降价使 Opus5 的性价比优势减弱。AI模型Fable 5.1Opus5Agent2 个信源在谈事件专题推荐理由:Fable 5.1 大幅降价,缓存价格仅原价四分之一,Agent 使用成本降25-45%,Opus5性价比受挑战。原文稍后读已读值得跟进有用关注 Fable 5.1
14:48IT之家(博客/媒体)73°Arena平台发布2026年第35周AI大模型盲测排行榜。国产GLM-5.3-Flash首次进入代码榜Top 10,ELO分数达1535分。Qwen3.8-Max-0902首次入榜即登顶前端开发榜榜首,ELO分数未公布。Kimi-K3-Max稳定守住综合榜Top 10位置,ELO分数为1489分。AI模型GLM-5.3-FlashQwen3.8-MaxKimi-K3-Max2 个信源在谈事件专题推荐理由:国产模型在细分领域表现亮眼,GLM-5.3-Flash代码能力超越多数海外模型,千问3.8-Max直接登顶前端榜。原文稍后读已读值得跟进有用关注 GLM-5.3-Flash
13:48IT之家(博客/媒体)73°马斯克宣布 Grok 4.7 将于 9 月 12 日发布,参数量达 2.1 万亿,较 Grok 4.6 增长 40%。该模型在各方面表现优于 Grok 4.6,Token 效率更高。Grok 4.6 已超越 GPT-5.6 Sol,仅次于 Opus 5 和 Fable 5。马斯克称 Grok 4.7 将超越所有竞品。AI模型GrokGrok 4.7Elon Musk推荐理由:马斯克说 Grok 4.7 十天后上线,参数量暴涨 40%,性能要碾压所有 AI原文稍后读已读值得跟进有用关注 Grok
13:48官方一手marktechpost@Michal Sutter精选73°Meta Superintelligence Labs本周发布Muse Voice Transcribe模型,将语音识别、说话人分离和端点检测三个功能整合为一个自回归模型。该模型专为实时流式语音处理设计,解决了传统语音系统中多个模型交接带来的延迟和故障点问题。Muse Voice Transcribe通过单一模型完成三项任务,提高了语音处理的效率和可靠性。AI模型Muse Voice TranscribeMeta语音识别2 个信源在谈事件专题推荐理由:Meta把语音识别、说话人分离和端点检测三个模型合成了一个,延迟更低,故障点更少。原文稍后读已读值得跟进有用关注 Muse Voice Transcribe
12:58官方一手歸藏(guizang.ai)@op741873°Claude发布了Fable 5.1和Mythos 5.1模型,两者权重相同。输入输出价格与Fable 5保持一致,缓存价格降低75%。官方表示典型负载成本降低约25%,重度Agent负载降低约45%。但用户报告称Fable 5.1订阅额度消耗极快,20-30分钟内可能用完。AI模型ClaudeFable 5.1Mythos 5.13 个信源在谈事件专题推荐理由:Claude新模型Fable 5.1和Mythos 5.1发布,缓存降价75%,但实际成本可能更高,还有额度消耗快和功能限制问题。原文稍后读已读值得跟进有用关注 Claude
12:46量子位@梦晨Claude最强Fable 5.1版本正式发布,在8项基准测试中取得领先成绩。该版本引入反蒸馏机制,最高降价达45%。新版本能够处理更复杂的任务,尤其在困难任务完成度上有显著提升。AI模型ClaudeFable反蒸馏推荐理由:Claude发布了Fable 5.1,8项基准测试领先,降价45%,还加入了反蒸馏机制。原文稍后读已读值得跟进有用关注 Claude
12:13官方一手歸藏(guizang.ai)@op741878°李飞飞的World Labs发布了新世界模型Atlas,能从单张图片生成完整3D场景。Atlas支持三大任务:生成最长1分钟1440p的视频,重建3D场景效果超过专业模型,以及时空仿真。模型能将多张图像整合到共享空间上下文中,理解时间演变规律。AI模型AtlasWorld Labs李飞飞推荐理由:World Labs的Atlas能从单张图片生成3D场景,视频生成长达1分钟,效果超过专业3D重建模型。原文稍后读已读值得跟进有用关注 Atlas
11:53官方账号阿里通义 Qwen@Alibaba_Qwen73°Qwen3.8-Max-0902在CodeArena WebDev排行榜上以1691分位居第一,比Claude Opus 5高出3分,比Kimi K3高出17分。该模型在多步推理、工具使用和完整应用生成方面表现突出,价格为每百万token 5美元。在WebDev各个细分类别中,该模型在数据分析与消费者产品类别排名第一。AI模型Qwen3.8-Max-0902CodeArenaWebDev推荐理由:阿里Qwen3.8-Max-0902以1691分登顶CodeArena WebDev排行榜,比前代模型高出22分,价格仅5美元/百万token。原文稍后读已读值得跟进有用关注 Qwen3.8-Max-0902