04:04DeepLearning.AI@DeepLearningAI73°OpenAI展示GPT 5.6 Sol每秒处理750个token。Google发布Gemini 3.7 Flash平均每秒330个token。Nvidia推出Nemotron 3.5 Lightning并配备NeMo Switchyard动态步进路由技术。更快的吞吐量和更低的延迟可减轻开发者上下文切换负担。这些模型支持实时智能体工作流。AI模型GPT 5.6Gemini 3.7Nemotron 3.510 个信源在谈事件专题推荐理由:OpenAI、Google和Nvidia都在竞相提升AI模型推理速度,各有不同技术方案。原文稍后读已读值得跟进有用关注 GPT 5.6
11:38IT之家(博客/媒体)78°Anthropic最大模型Fable 5发布两个月后,支出占比仅11%,用户转向更便宜替代品。Fable 5价格高,旧模型能满足需求。OpenAI GPT 5.6定价低于Fable 5,表现强劲。Anthropic IPO前面临不确定性,收入增长放缓。行业AnthropicFable 5OpenAI10 个信源在谈事件专题推荐理由:Anthropic Fable 5 价格昂贵,用户转向更便宜的替代品,OpenAI GPT 5.6 表现强劲,值得关注。原文稍后读已读值得跟进有用关注 Anthropic
05:03官方账号Simon Willison’s Weblog(博客/媒体)78°Anthropic的年度收入达到650亿美元,预计第三季度将盈利。尽管如此,其Opus 5模型在7月份发布后,用户增长缓慢,Ramp AI指数显示其市场份额仅为8.0%。与此同时,OpenAI的年度收入增长35%,达到400多亿美元,GPT 5.6的发布推动了公司业绩。行业AnthropicOpus 5OpenAI10 个信源在谈事件专题推荐理由:Anthropic的Opus 5模型虽然性能强大,但因其成本较高而难以吸引用户,相比之下,OpenAI的GPT 5.6凭借较低的成本获得了更多用户。原文稍后读已读值得跟进有用关注 Anthropic
07:17lmarena.ai@lmarena_ai精选71°Agent Arena 新增代码、工作、聊天三个分类榜单。代码榜第一是 OpenAI 的 GPT 5.6 Sol(xHigh)。工作榜和聊天榜第一均为 Anthropic 的 Claude Opus 5(High 和 Max)。该评测基于数百万真实长时程智能体任务,单次长会话成本可达数百至一千美元。AI模型Agent ArenaGPT 5.6Claude Opus 510 个信源在谈事件专题推荐理由:想知道代码、工作、聊天分别谁最强?Agent Arena 新榜单给出答案:GPT 5.6 和 Claude Opus 5 各领风骚。原文稍后读已读值得跟进有用关注 Agent Arena
04:14官方账号Perplexity@perplexity_aiPerplexity Computer 现已上线 GPT 5.6 Terra 和 Luna 两款新模型。Terra 成为所有 Computer 子代理的默认模型。Luna 则作为计划自动化的主要模型。Terra 也可作为编排模型使用。AI产品GPT 5.6Perplexity ComputerTerra1 个信源在谈事件专题推荐理由:Perplexity 把 GPT 5.6 Terra 和 Luna 放进 Computer 了,子代理默认用 Terra,自动化用 Luna,编排也能选 Terra。原文稍后读已读值得跟进有用关注 GPT 5.6
00:32Amjad Masad@amasadAmjad Masad开发的LLM国际象棋引擎已上线LiChess,当前Elo 1253,可自主与真人及机器人对弈。该引擎基于8B参数模型,结合高推理与响应链接,持续击败GPT 5.6和Stockfish难度0。它每步仅耗时1-2秒,相比之下对手平均需要30秒。免费试玩地址为qwen-chess.replit.app。AI产品LiChessGPT 5.6Stockfish推荐理由:Amjad Masad用8B模型做了个国际象棋引擎,LiChess 1253分,能赢GPT 5.6和Stockfish初级,每步只要1-2秒,在线可玩。原文稍后读已读值得跟进有用关注 LiChess
23:08Viking@vikingmutevikingmute 分享了一套多模型协作调试流程:几轮搞不定的问题,用 /handoff 把会话压成交接文档,避免上下文被污染。他还会并行开 worktree 让多个模型改 bug,最后由主模型 reconcile。以 GPT 5.6 两次十分钟以上未完成的任务为例,Grok 4.5 三分钟就搞定了,所以别在一个模型上恋战。技巧GPT 5.6Grok 4.5/handoff推荐理由:改 bug 别恋战:/handoff 交接 + 多模型并行,GPT 5.6 卡住的活 Grok 4.5 三分钟搞定。原文稍后读已读值得跟进有用关注 GPT 5.6
14:14官方账号Latent Space (swyx)(博客/媒体)OpenAI将GPT 5.6价格下调20%-80%。由于GPT 5.6的递归自我优化,GPT 5.4的智能成本在4个月内下降了13倍。蒸馏技术在其中起到关键作用。AI模型GPT 5.6GPT 5.4模型蒸馏10 个信源在谈事件专题推荐理由:GPT 5.6大幅降价,最高降八成,四个月前GPT 5.4的算力成本现在只要十三分之一,做AI应用的成本压力能小不少。原文稍后读已读值得跟进有用关注 GPT 5.6
03:08v0@v0Kimi K3 在 Deepsec.sh 私有网络安全基准测试中达到最佳性价比,召回率与价格平衡。GPT 5.6 召回率最高但单次运行成本是 Kimi K3 的 7 倍以上。GLM 5.2 价格比 Kimi K3 低 40%,召回率接近。Fable 5 完全拒绝执行,无法用于安全分析。推荐用 GPT 5.6 做一次性基线,用 Kimi K3 做持续分析。AI模型Kimi K3GPT 5.6GLM 5.210 个信源在谈事件专题推荐理由:Malte Ubl 实测发现 Kimi K3 在网络安全漏洞检测上性价比吊打 GPT 5.6,适合做持续扫描,省大钱。原文稍后读已读值得跟进有用关注 Kimi K3
01:00lmarena.ai@lmarena_ai82°OpenAI 的 GPT 5.6 Sol (xHigh) 在 Agent Arena 中排名第四,而 Anthropic 的 Claude Opus 5 (Max) 以 11.88% 的净提升位列第二,Opus 5 (High) 以 11.73% 净提升位列第三。Opus 5 Max 在 Confirmed Success 和 Praise vs Complaint 信号上均排名第一。Fable 5 (High) 在性价比上表现最优。Arena.ai 基于超过 7000 次真实世界智能体会话得出排名。AI模型Claude Opus 5GPT 5.6Agent Arena10 个信源在谈事件专题推荐理由:想比较 Claude Opus 5 和 GPT 5.6 在真实智能体任务上的表现?这份报告用 7000+ 次任务告诉你谁更强、谁更划算。原文稍后读已读值得跟进有用关注 Claude Opus 5
07:18官方账号Greg Brockman@gdbOpenAI 的 GPT 5.6 Sol 被认为是最有趣的数学模型。Thomas Bloom 检查了 erdosproblems.com 上几个新证明,均正确。这些证明包含有趣的想法。推文认为数学与科学进步已接近。AI模型GPT 5.6SolOpenAI8 个信源在谈事件专题推荐理由:OpenAI 的 GPT 5.6 Sol 在数学证明上表现靠谱,检查了几项新证明全对,还带来了新思路。原文稍后读已读值得跟进有用关注 GPT 5.6
09:52Guillermo Rauch@rauchg精选72°Moonshot AI的Kimi K3在一项私有网络安全基准测试中表现顶级,召回/精度/价格比优秀。Sol模型安全能力大幅跃升,但成本是第二名的7倍以上。GPT 5.6召回和精度最佳,但价格最高。Fable 5完全拒绝执行任务,无法用于安全分析。建议用Sol做单次基线,Kimi K3做持续分析。AI模型Kimi K3SolGPT 5.610 个信源在谈事件专题推荐理由:Moonshot AI的Kimi K3在网络安全任务上性价比很高,比GPT 5.6便宜7倍但效果接近,适合做代码安全审计。原文稍后读已读值得跟进有用关注 Kimi K3
00:25elvis@omarsar0Gavin Baker指出,Kimi K3可能成为AI的重要转折点。Kimi K3推理成本比GPT 5.6高50-70%(Artificial Analysis),且token效率低,每个任务的实际成本高于GPT 5.6和Grok 4.5。开源模型需要相同算力运行,但会降低模型层利润率,利好基础设施和应用层。这一趋势可能对Anthropic和OpenAI不利,但对其他公司是净正面。行业Kimi K3GPT 5.6Grok 4.510 个信源在谈事件专题推荐理由:Gavin Baker说Kimi K3可能改变AI格局,开源模型会让推理更便宜,对大部分公司利好。原文稍后读已读值得跟进有用关注 Kimi K3
03:07The Rundown AI@therundownaiMoonshot发布开源模型Kimi K3。早期基准测试中,Kimi K3全面超越Claude Opus 4.8。性能与Fable和GPT 5.6 Sol相当。定价与Sonnet相同。可能成为今年DeepSeek时刻。AI模型Kimi K3MoonshotClaude Opus 4.810 个信源在谈事件专题推荐理由:开源模型Kimi K3性能吊打Claude Opus 4.8,价格却和Sonnet一样,值得关注。原文稍后读已读值得跟进有用关注 Kimi K3
00:09OpenRouter@OpenRouterAIOpenRouter推出并排比较功能,用户可一键对比所有GPT 5.6变体。页面展示多个版本,帮助快速选择。支持直接通过链接访问比较界面。AI产品OpenRouterGPT 5.6模型对比推荐理由:OpenRouter把GPT 5.6所有变体放一起对比,不用自己来回切换,选模型更省事。原文稍后读已读值得跟进有用关注 OpenRouter
11:41向阳乔木@vista8GPT 5.6推出Ultra模式,通过并行运行多个Sub-agent来加速推理。Terra和Sol型号支持Ultra模式,而最便宜的Luna型号仅支持Extra High。该功能被描述为“又快又好”,但具体性能数据未公布。AI模型GPT 5.6Ultra模式Sub-agent推荐理由:GPT 5.6的Ultra模式让子智能体并行跑,比之前快很多。但只有高价版能用,便宜版只给了Extra High。原文稍后读已读值得跟进有用关注 GPT 5.6
13:10官方一手歸藏(guizang.ai)@op7418精选71°OpenAI 发布了 GPT 5.6 模型,并将原有的 Codex 应用改名为 ChatGPT 应用,界面重新设计。新应用拆分为 Work 和 Code 两个 Tab,但用户反馈两者区别不大,且聊天窗口被缩至右下角小弹窗。Site 插件上线,可生成网页并连接业务数据、部署到 OpenAI 网站。移动端 ChatGPT 现在也能调用原 Codex 插件,浏览器使用和计算机使用功能更快更准确。AI产品GPT 5.6CodexOpenAI10 个信源在谈事件专题推荐理由:OpenAI 把 Codex 改成了 ChatGPT 应用,拆分 Work 和 Code 两个模式,还上了 Site 插件能直接生成网页并部署,移动端也能用插件了,快去试试新交互。原文稍后读已读值得跟进有用关注 GPT 5.6
08:22orange.ai@oran_geA社因Fable 5模型占用大量GPU资源,最初未将其纳入coding plan,而是采取限时体验并按API定价销售以获利。GPT 5.6的发布吸引了大量用户,导致Fable 5用户流失。A社随后调整策略,将Fable 5重新放回coding plan。这一轮变化体现了产品定价受替代品影响。AI模型Fable 5GPT 5.6A社8 个信源在谈事件专题推荐理由:A社原来把Fable 5当API卖赚钱,结果GPT 5.6一来用户全跑了,它又把模型塞回coding plan。竞争就是这么直接。原文稍后读已读值得跟进有用关注 Fable 5
14:03向阳乔木@vista8用户发现身边朋友的生活节律被Codex和Claude Code的5小时重置控制。新的GPT 5.6 sol开启高速和ultra模式,几十分钟就能耗光200美元对应的5小时额度。退回正常速度和Medium模式可以更持久。AI产品GPT 5.6CodexClaude Code推荐理由:看看GPT 5.6的额度消耗有多快,高速模式几十分钟烧掉200刀,老用户吐槽不已。原文稍后读已读值得跟进有用关注 GPT 5.6
19:58Geek@geekbb一条推文提出GPT 5.6、Grok 4.5、GLM 5.2三款模型的组合能否超越Claude Fable 5的问题。该推文获得1599次查看和2次投票。评论区有2条讨论,目前尚无定论。AI模型GPT 5.6Grok 4.5GLM 5.28 个信源在谈事件专题推荐理由:看看网友在聊GPT 5.6、Grok 4.5、GLM 5.2和Claude Fable 5谁更强,挺有意思的。原文稍后读已读值得跟进有用关注 GPT 5.6
11:59LlamaIndex@llama_index88°OpenAI今日发布GPT 5.6系列模型。Llama Index在ParseBench基准上进行测试,评估文档理解能力。新模型在阅读文本和表格方面表现优异,但在图表和布局上仍有困难。Luna版本比Sol版本便宜约6倍,但性能下降微小,表明增加推理token不一定改善视觉理解。AI模型GPT 5.6OpenAIParseBench10 个信源在谈事件专题推荐理由:OpenAI刚发了GPT 5.6,Llama Index实测:读文字表格很强,看图表还差点意思。便宜6倍的Luna版性价比很香。原文稍后读已读值得跟进有用关注 GPT 5.6
09:48官方一手歸藏(guizang.ai)@op741883°OpenAI 发布了 GPT 5.6(分为 Sol、Terra、Luna 三个版本)以及全新的 ChatGPT 桌面应用(原 Codex 改名)。新版应用将聊天窗口缩至右下角小弹窗,并强行拆分出 Work 和 Code 两个 Tab。同时新增 Sites 插件,可直接生成网页并部署到 OpenAI 网站;移动端 ChatGPT 现在也能调用原 Codex 插件。用户普遍反映界面改变导致找不到历史聊天记录,体验混乱。AI产品GPT 5.6OpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 昨晚突然更新,GPT 5.6 来了,但界面改得让人懵圈——聊天缩成小窗,还硬分 Work 和 Code 两个 Tab,老用户可能会找不到以前的记录,建议先看看再决定要不要升级。原文稍后读已读值得跟进有用关注 GPT 5.6
09:43官方一手歸藏(guizang.ai)@op7418Anthropic在昨晚不寻常时间重置了所有用户的5小时和周使用额度。此举发生在GPT 5.6和ChatGPT App更新之后。ClaudeDevs开发者账号在评论区贴脸开大,引发关注。行业AnthropicGPT 5.6ChatGPT App10 个信源在谈事件专题推荐理由:Anthropic悄悄取消使用限制,可能是被GPT更新逼急了,开发者还在评论区拱火,有意思。原文稍后读已读值得跟进有用关注 Anthropic
17:04orange.ai@oran_ge88°据海外内测反馈,GPT 5.6 是 GPT 5.5 的全面升级版本,定价与 5.5 相同。内测者普遍认为 GPT 5.6 与 Fable 在各项表现上存在差距,Fable 虽价格是 GPT 5.6 的两倍,但仍被视为智能巅峰。目前尚无官方基准数据公布。AI模型GPT 5.6GPT 5.5Fable10 个信源在谈事件专题推荐理由:GPT 5.6 明天发布,价格不变但性能不如两倍价的 Fable,想升级的可以等等看。原文稍后读已读值得跟进有用关注 GPT 5.6
11:57小互@imxiaohuAXIOS报道,特朗普政府解除了对OpenAI的GPT 5.6模型的限制。美国商务部已正式批准OpenAI广泛推出其GPT 5.6模型。该模型此前受到出口管制或安全审查。此举意味着OpenAI可以在全球范围内部署GPT 5.6。具体基准或版本细节尚未公布。行业OpenAIGPT 5.6特朗普政府10 个信源在谈事件专题推荐理由:美国政府批准OpenAI推出GPT 5.6,监管松绑了,看看这模型有啥不一样。原文稍后读已读值得跟进有用关注 OpenAI
23:09小互@imxiaohuOpenAI 休假一周后回归,预计本周全面上线 GPT 5.6 模型。同时将推出实时语音控制功能。内部消息称上线日期可能在7月7日。相关推文已获得23次点赞和4605次查看。AI模型OpenAIGPT 5.6实时语音控制10 个信源在谈事件专题推荐理由:OpenAI 被传本周上线 GPT 5.6 和实时语音控制,7月7号可能见分晓,科技圈都在看。原文稍后读已读值得跟进有用关注 OpenAI
16:17小互@imxiaohu据社交平台爆料,OpenAI 可能在今晚发布 GPT 5.6 模型。该推文已有 10 条评论、7 个点赞和 886 次查看。目前尚无官方确认或具体参数信息。AI模型GPT 5.6OpenAI模型发布9 个信源在谈事件专题推荐理由:OpenAI 可能要发 GPT 5.6 了,虽然没有细节,但可以蹲一下今晚的更新。原文稍后读已读值得跟进有用关注 GPT 5.6
12:46AI Will@FinanceYF584°据The Information报道,美国政府已要求OpenAI在其政府审查期间暂缓发布GPT 5.6模型。OpenAI CEO Sam Altman回应表示这并非公司偏好的长期模式。该事件可能影响GPT 5.6的上市时间表,并引发对AI模型安全审查流程的讨论。行业OpenAIGPT 5.6AI安全10 个信源在谈事件专题推荐理由:美国政府直接要求OpenAI推迟GPT 5.6发布,Sam Altman也表态了,这事关AI监管风向。原文稍后读已读值得跟进有用关注 OpenAI