9月3日
01:35
01:33
01:33Varun Mohan@_mohansolo
Gemini 3.8 Flash已正式发布,相比3.7 Flash版本在智能体编程和通用知识工作方面有显著提升。该模型已在内部团队中使用并获得良好反馈。现在所有用户都可以通过Antigravity平台访问这一新版本。
事件专题

推荐理由:Google发布了Gemini 3.8 Flash,在编程和知识工作上比前代更强,现在人人都能用。
01:13
00:50
00:50Sundar Pichai@sundarpichai
73°
3.8 Flash Cyber 在真实 Chrome 安全漏洞评估中,比更大模型多产生 2.6 倍的正确补丁。Google 通过 Fairwind 计划向政府机构和网络安全合作伙伴提供该模型访问权限。该模型在真实世界用例中展现出超越基准测试的能力。
推荐理由:Google 发布的 3.8 Flash Cyber 模型在真实安全漏洞修复上比大模型强 2.6 倍,现在政府机构也能用上了。
00:45
00:45官方账号Google DeepMind@GoogleDeepMind
谷歌推出Gemini 3.8 Flash模型,在软件工程、智能体任务和多步推理方面相比3.7 Flash有显著提升。同时发布Gemini 3.8 Flash Cyber模型,具备前沿级漏洞检测和自动修补能力。这两个新模型旨在帮助扩展AI代理并保障代码安全。

推荐理由:谷歌发布了Gemini 3.8系列模型,一个提升推理能力,一个专注网络安全,都是各自领域的升级款。
00:40
00:40Paul Couvert@itsPaulAi
73°
Google发布Gemini 3.8 Flash模型,距离3.7 Flash仅20天。新版本性能与Opus 5和GPT-5.6 Sol相当,但价格仅为前者的1/6和1/5。Google称这是其迄今为止最好的推理和编码模型,包含两个新变体:Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。
事件专题

推荐理由:Google刚发布Gemini 3.8 Flash,性能媲美顶级模型但价格便宜5-6倍,彻底改变了Flash模型的定位。
00:33
00:33lmarena.ai@lmarena_ai
78°
Gemini 3.8 Flash (High)在Agent Arena排名第14,较3.7版本提升5.94个百分点。在Text Arena中位列第7,超越Claude Opus 5 (High)的1492分。该模型在写作、多轮对话和长查询等类别中排名显著提升。
事件专题

推荐理由:GoogleDeepMind发布Gemini 3.8 Flash (High),在多个基准测试中超越前代版本和Claude Opus 5。
00:28
00:28
00:17
00:14
00:14Google Gemini App@GeminiApp
73°
Google今日发布Gemini 3.8 Flash模型,Pro和Ultra用户可使用。该模型针对日常话题提供可靠全面的建议,并支持文本分析和复杂编码等深度任务。Gemini 3.8 Flash在响应质量和实用性方面有所提升。
事件专题

推荐理由:Google发布了Gemini 3.8 Flash,Pro和Ultra用户现在可以用它做文本分析和复杂编程了。
00:13
00:13
9月2日
23:33
23:33IT之家博客/媒体
精选73°
谷歌在 Google DeepMind 网站上线了 Gemini 3.8 Flash 模型,基于 Gemini 3.7 Flash 开发。该模型拥有最高 1M token 上下文窗口和 64K token 文本输出能力。在编程、知识处理、多模态处理等基准测试中表现优异。模型面向个人用户、开发者和企业,适合软件工程和智能体任务场景。
事件专题

推荐理由:谷歌新发布的 Gemini 3.8 Flash 模型,在软件工程和智能体任务方面有提升,支持自定义努力水平,适合大规模部署。
20:53
20:53官方账号Decoder@Jonathan Kemper
精选73°
World Labs由AI研究员李飞飞联合创立,推出Atlas模型。该模型仅需几张照片即可生成、重建和模拟3D场景。Atlas在3D空间中锚定所有输入,而非处理为平面序列。公司称其性能超过专业模型。Atlas还能在模拟中生成机器人训练数据。

推荐理由:李飞飞团队出的Atlas模型,几张照片就能生成3D世界,还能做机器人训练数据,比专业模型还强。
18:58
18:43
16:29
16:29官方一手pandaily@contact@pandaily.com (Pandaily)
精选73°
科大讯飞全资子公司发布并开源了Spark X2.5-4B和X2.5-1.7B模型。这两款模型原生支持高达100万token的上下文长度。它们是首批支持如此长上下文的边缘模型。这些模型专为设备端AI设计。

推荐理由:科大讯飞开源了百万token上下文的边缘模型,比普通模型能处理更长文本,适合设备端部署。
16:13
16:13爱范儿@莫崇宇
李飞飞团队发布了全球首个多模态世界模型 Atlas。该模型仅需几张照片就能省去传统拍摄所需的数百个机位。Atlas 能够理解空间关系,为影视制作带来新可能。这一技术突破将改变内容创作方式。
推荐理由:李飞飞团队新发布的 Atlas 模型,几张照片就能替代传统拍摄中的数百个机位,理解空间关系。
16:03
15:58
15:58官方账号Latent Space (swyx)博客/媒体
Anthropic 发布 Claude Fable/Mythos 5.1 模型,成为新的 SOTA 模型。该模型缓存价格降低 75%,同时输出 token 增加 70%。新模型在多个基准测试中表现优异,为用户提供更高性价比的选择。
事件专题

推荐理由:Anthropic 推出 Claude Fable/Mythos 5.1,价格大幅降低但输出能力提升,性价比超高。
15:03
14:48
14:48IT之家博客/媒体
73°
Arena平台发布2026年第35周AI大模型盲测排行榜。国产GLM-5.3-Flash首次进入代码榜Top 10,ELO分数达1535分。Qwen3.8-Max-0902首次入榜即登顶前端开发榜榜首,ELO分数未公布。Kimi-K3-Max稳定守住综合榜Top 10位置,ELO分数为1489分。
事件专题

推荐理由:国产模型在细分领域表现亮眼,GLM-5.3-Flash代码能力超越多数海外模型,千问3.8-Max直接登顶前端榜。
12:58
12:58官方一手歸藏(guizang.ai)@op7418
73°
Claude发布了Fable 5.1和Mythos 5.1模型,两者权重相同。输入输出价格与Fable 5保持一致,缓存价格降低75%。官方表示典型负载成本降低约25%,重度Agent负载降低约45%。但用户报告称Fable 5.1订阅额度消耗极快,20-30分钟内可能用完。
事件专题

推荐理由:Claude新模型Fable 5.1和Mythos 5.1发布,缓存降价75%,但实际成本可能更高,还有额度消耗快和功能限制问题。
12:46

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。