18:54The Rundown AI@therundownaiAnthropic终止了Fable 5模型的访问权限。Rundown圆桌讨论分享了AI使用案例。通过ChatGPT Sites可在几分钟内部署迷你SaaS。OpenAI CFO提出新的AI预算计算方法。还介绍了4个新AI工具和社区工作流。行业AnthropicFable 5ChatGPT Sites10 个信源在谈事件专题推荐理由:今天AI圈动静不小:Anthropic停了Fable 5,ChatGPT Sites帮你快速搭SaaS,OpenAI CFO算账有新思路,再加4个好用工具,不点开就亏了。原文稍后读已读值得跟进有用关注 Anthropic
17:12IT之家(博客/媒体)Reddit用户反馈在Mac上运行OpenAI Codex桌面应用后系统明显卡顿,关闭应用后仍持续,只有彻底重启才能恢复。此前6月Codex日志写入漏洞被曝光,21天内写入约37TB数据,0.142.0版本修复后写入降低约85%,但M4 MacBook Air测试仍保持约207MB/分钟写入。Codex还导致macOS Gatekeeper守护进程syspolicyd的CPU占用飙升至125%-200%,内存超8GB。用户需升级至最新版本,或临时将日志文件符号链接到内存路径以减少SSD磨损。AI产品OpenAICodexMac10 个信源在谈事件专题推荐理由:OpenAI Codex在Mac上仍有卡顿和SSD磨损问题,关闭应用也救不了。如果你用Mac用Codex,快检查写入量或升级版本。原文稍后读已读值得跟进有用关注 OpenAI
13:36IT之家(博客/媒体)月之暗面于7月16日发布Kimi K3模型,拥有2.8万亿参数,在Frontend Code Arena以1679分超越Claude Fable 5位居第一,并即将开放权重。OpenAI新任战略未来主管Dean W. Ball批评该开源行为是减速主义,会阻碍AI资本支出,虽承认Kimi K3非常优秀。Dean W. Ball还渲染开源危险论,建议美国政府制造监管恐慌来打压对手,例如发布“中国模型可能存在后门”的软性法规。Dean W. Ball本月刚加入OpenAI,此前担任白宫科技政策办公室高级顾问。AI模型Kimi K3月之暗面OpenAI10 个信源在谈事件专题推荐理由:月之暗面Kimi K3刚登顶编程榜单,OpenAI新主管就跳出来批开源是“减速主义”,还教美国政府怎么使绊子,这瓜值得吃。原文稍后读已读值得跟进有用关注 Kimi K3
12:09官方账号Simon Willison’s Weblog(博客/媒体)2026 年 Musk 诉 Altman 案中曝光了 Sam Altman 于 2022 年 10 月 1 日发给 OpenAI 董事会的邮件。邮件称 OpenAI 正讨论开源策略,计划很快发布一个能力接近 GPT-3、可在消费级硬件上本地运行的语言模型。Altman 认为此举能阻止 Stability 等公司发布类似模型,并削弱新竞品的融资能力。行业Sam AltmanOpenAIGPT-310 个信源在谈事件专题推荐理由:法庭文件挖出两年前的内部邮件,Altman 亲口说要抢在别人前头搞开源,这波猛料值得吃瓜。原文稍后读已读值得跟进有用关注 Sam Altman
07:18官方账号Greg Brockman@gdbOpenAI 的 GPT 5.6 Sol 被认为是最有趣的数学模型。Thomas Bloom 检查了 erdosproblems.com 上几个新证明,均正确。这些证明包含有趣的想法。推文认为数学与科学进步已接近。AI模型GPT 5.6SolOpenAI8 个信源在谈事件专题推荐理由:OpenAI 的 GPT 5.6 Sol 在数学证明上表现靠谱,检查了几项新证明全对,还带来了新思路。原文稍后读已读值得跟进有用关注 GPT 5.6
03:51官方账号Greg Brockman@gdbChatGPT Work 支持在云端运行,用户可在手机上使用,无需保持笔记本打开。这一特性解决了此前代理工具需保持设备开启的限制。推文作者强调,这是ChatGPT Work的最佳功能之一。该功能带来更灵活的工作流体验。AI产品ChatGPTChatGPT WorkOpenAI10 个信源在谈事件专题推荐理由:ChatGPT Work 可以在云端跑,手机也能用,再也不用一直开着笔记本了,很实用!原文稍后读已读值得跟进有用关注 ChatGPT
03:27techcrunch@Anthony Ha苹果对OpenAI提起的诉讼可能影响其进军硬件市场的计划,包括开发AI芯片和智能设备。同时,该诉讼也给OpenAI的IPO进程带来不确定性,原计划2026年上市。诉讼焦点涉及OpenAI从苹果挖角工程师和专利侵权,苹果要求赔偿10亿美元。行业AppleOpenAI诉讼10 个信源在谈事件专题推荐理由:苹果告OpenAI挖人又侵权,这事可能让OpenAI的硬件和上市计划泡汤,值得关注。原文稍后读已读值得跟进有用关注 Apple
10:14Browser Use@browser_useBrowser Use Cloud 新服务允许开发者使用一个 BROWSER_USE_API_KEY 即可访问 OpenAI、Anthropic 和 Google 提供的多个前沿模型。用户只需在代码中替换一个字符串即可切换提供商,无需管理多个 API 密钥。该工具基于开源项目 Browser Use,安装仅需执行 pip install browser-use 命令。目前支持至少三家主流模型提供商,简化了多模型调用流程。AI产品Browser UseOpenAIAnthropic10 个信源在谈事件专题推荐理由:Browser Use Cloud 用一个密钥打通 OpenAI、Anthropic 和 Google 的模型,安装就一行命令,省去来回切换密钥的麻烦。原文稍后读已读值得跟进有用关注 Browser Use
07:51orange.ai@oran_geOpenAI 战略部向 Kimi 发送邮件,指出开源如此智能的模型存在巨大安全风险。尽管 K3 在 agentic coding 任务上与 2026 年 Q1 顶级模型相当,但评论认为其距离 AGI 仍有数年差距。观察者 Dean W. Ball 表示,中国允许开源 K3 令人意外,可能源于战略盲视、出口管制导致的算力不足,以及缺乏 AGI 威胁认知。他还指出,开源权重模型本质上是减速主义,最终可能导向 AI 共产主义。行业KimiK3OpenAI10 个信源在谈事件专题推荐理由:OpenAI 战略部给 Kimi 写小作文说开源太智能有风险,K3 真的那么强吗?看看行业大佬怎么拆解背后的战略博弈。原文稍后读已读值得跟进有用关注 Kimi
20:57@koltregaskes@koltregaskes白宫Gold Eagle计划据报道赋予特朗普政府直接决定谁可访问OpenAI和Anthropic前沿模型的权力,此前由实验室自主控制。CNBC称上月政府以国家安全为由阻止了Claude Mythos 5和Fable 5的发布,谈判数周后才恢复访问。尽管白宫官员称测试自愿且发布决策权在公司,但实际操作显示更严约束。与此同时,中国Moonshot AI的Kimi K3在性能上追平Fable和GPT-5.6,并在至少一项独立基准上超越两者,David Sacks警告这可能导致美国输掉AI竞赛。行业Gold EagleOpenAIAnthropic10 个信源在谈事件专题推荐理由:白宫新规直接卡OpenAI和Anthropi的模型发布,跟国内Kimi K3的逆袭放一起看,特有意思。原文稍后读已读值得跟进有用关注 Gold Eagle
15:45官方账号Decoder@Matthias BastianAnthropic将于7月20日起在Max和Team Premium计划中纳入Claude Fable 5,但仅提供常规限额的50%,而常规限额同日将削减三分之一。Pro用户将获得一次性100美元信用额度,此后按API费率支付。这一逆转源于OpenAI更便宜的GPT-5.6 Sol带来的竞争压力。AI产品AnthropicClaude Fable 5GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Anthropic调整Fable 5订阅:Max和Team配额减半,Pro用户一次性补贴后走API,应对OpenAI的GPT-5.6 Sol低价冲击。原文稍后读已读值得跟进有用关注 Anthropic
11:52Geek@geekbb该项目利用OpenAI视觉模型自动识别照片中的衣物,并进行自动抠图。随后基于抠图结果生成模特上身预览效果。配套的Codex技能支持一键导入衣物素材或生成模特穿搭画册。整个流程可帮助电商卖家快速制作商品展示图。技巧OpenAICodex多模态9 个信源在谈事件专题推荐理由:这个开源项目用OpenAI视觉模型自动识别衣物、抠图,还能生成模特上身图,适合电商卖家快速出图。原文稍后读已读值得跟进有用关注 OpenAI
11:15shao__meng@shao__mengTibo 发起活动,鼓励推友分享使用 GPT-5.6 Sol 的心得或切换到 Codex 的原因。前 10000 个审核通过的帖子可获得 $100 Codex Credits,作者本人已获得这笔奖励。实际查看帖子后发现大量僵尸账号,内容真实性低,因此抢先发帖比内容质量更重要。技巧GPT-5.6 SolCodexOpenAI10 个信源在谈事件专题推荐理由:Tibo 搞了个活动,前一万个发帖就送 $100 Codex Credits,别管内容真不真,冲就完了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
09:36IT之家(博客/媒体)OpenAI 于 7 月 17 日发布新版 macOS ChatGPT 桌面应用,整合 Chat、ChatGPT Work 和 Codex 三个组成部分。新应用支持对话历史在网页版、移动版和桌面版之间同步,用户可在侧边栏查看历史和项目。用户现在可以轻松切换 Chat 和 Work 模式,与网页版和移动版体验一致。Codex 模式保持不变,继续提供编程能力。AI产品ChatGPTOpenAImacOS10 个信源在谈事件专题推荐理由:OpenAI 这次把聊天、工作和编程三个功能整合到一个 macOS 应用里了,对话历史还能跨设备同步,用起来更方便。原文稍后读已读值得跟进有用关注 ChatGPT
08:39IT之家(博客/媒体)74°7 月 16 日,OpenAI 产品负责人 Tibo Sottiaux 回应了 GPT-5.6 Sol 擅自删除用户文件的投诉。该模型在“完全访问”模式下运行时,试图通过覆盖环境变量 $HOME 来定义临时工作目录,却失误删除了整个 $HOME 目录。OpenAI 正在更新开发者提示信息,引导用户切换至更安全的权限模式,并加固防护措施防止类似误操作。AI产品GPT-5.6 SolOpenAIAI安全10 个信源在谈事件专题推荐理由:OpenAI 承认最强模型 Sol 在完全访问模式下会误删文件,已经更新提示和防护,用的时候要小心权限设置。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
08:23ChatGPT@ChatGPTapp该推文由ChatGPT官方账号发布。目前获得2850次查看,1次转发和1次评论。具体内容未在摘要中明确,但涉及链接指向某个网站。行业ChatGPTOpenAIX10 个信源在谈事件专题推荐理由:ChatGPT发了条推文,有2850人看过,但内容没给全,自己点开看吧。原文稍后读已读值得跟进有用关注 ChatGPT
08:21IT之家(博客/媒体)据《华尔街日报》7月15日报道,针对AI行业的敌意升级为现实暴力威胁,OpenAI、Anthropic等公司已加强高管安保,部分出行需武装保镖随行。安保公司JPT Security高管称,几年前科技CEO无需保镖,现在安保费用已成预算项。今年早些时候,20岁反AI活动人士丹尼尔·莫雷诺-加马携带枪支和燃烧瓶试图纵火袭击OpenAI CEO萨姆·奥尔特曼的住宅,未遂。Anthropic也发生一名男子尾随员工进入总部,并威胁要杀死某位高管的事件。民调显示,美国民众对AI的观感比美国移民与海关执法局更差。行业OpenAIAnthropicJPT Security10 个信源在谈事件专题推荐理由:反AI情绪从网上骂战升级到现实暴力,OpenAI CEO家被纵火,Anthropic有人闯总部威胁杀人,行业已配备武装保镖。这篇讲得很具体,值得看看。原文稍后读已读值得跟进有用关注 OpenAI
07:25elvis@omarsar0推文作者认为OpenAI的/goal功能被低估,但需清晰目标。他利用单独的LLM(如Fable 5或GPT-5.6 Sol)构建了自己的/goal特性以减少LLM的偏见和奖励破解问题。GPT-5.6-Sol具备长时任务原生能力,无需/goal即可持续运行数天。作者将GPT-5.6-Terra/Luna作为子智能体,GPT-5.6-Sol作为顾问/裁判,使Codex订阅能更高效地完成复杂任务。技巧OpenAI/goalGPT-5.6-Sol10 个信源在谈事件专题推荐理由:作者分享了用独立LLM强化/goal的实用技巧,用GPT-5.6-Sol做裁判,让GPT-5.6-Terra/Luna当子智能体,跑得更久更快。原文稍后读已读值得跟进有用关注 OpenAI
06:55官方账号OpenAI@OpenAIOpenAI发布教程,指导用户如何在Codex中添加Codex Security插件。安装完成后,按钮变为“Try in chat”,点击后启动新的Codex聊天并预填安全扫描提示。用户需选择包含待审查代码的文件夹,发送扫描提示即可开始安全扫描。整个过程无需额外配置,插件直接集成在Codex界面中。技巧CodexCodex SecurityOpenAI10 个信源在谈事件专题推荐理由:OpenAI出了Codex Security安全扫描插件,加进去就能一键审查代码漏洞,操作很简单,跟着三步走就行。原文稍后读已读值得跟进有用关注 Codex
06:54官方账号OpenAI@OpenAI91°GPT-5.6 Sol在“The Last Ones”网络靶场中达到网络安全领域新SOTA。该能力已转化为实际防御效果,帮助团队在真实代码中查找、验证和修复漏洞。OpenAI将其集成到Codex Security中供用户使用。AI模型GPT-5.6SolOpenAI10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6 Sol在网络安全靶场拿了第一,还能直接帮团队修真实漏洞,试试Codex Security吧。原文稍后读已读值得跟进有用关注 GPT-5.6
06:34官方账号Greg Brockman@gdbOpenAI 近期推出了 /goal 功能,但 GPT-5.6-sol 模型无需该功能即可持续执行任务直至完成。Shopify 的 tobi lutke 在 X 上表示,GPT-5.6-sol 是第一个不再需要 /goal 的模型,能自己持续推进任务。该推文获得 201 个赞和超过 2.2 万次查看。AI模型GPT-5.6-solOpenAI智能体10 个信源在谈事件专题推荐理由:OpenAI 悄悄升级了 GPT-5.6-sol,它能自己把事做完,不用你再设目标了,执行力超强。原文稍后读已读值得跟进有用关注 GPT-5.6-sol
06:29ChatGPT@ChatGPTappOpenAI 官方 ChatGPT 推文发布了一个新域名 bra-eclipse-atlas.openai.chatgpt.site。该推文目前仅获得 0 条回复、0 次转发和 1 个赞,总查看数为 356。该推文没有附带任何文字说明,只包含该链接。行业OpenAIChatGPT域名10 个信源在谈事件专题推荐理由:OpenAI 又搞了个新域名,可能是新项目或测试工具,去看一眼或许有惊喜。原文稍后读已读值得跟进有用关注 OpenAI
06:27ChatGPT@ChatGPTapp一条来自ChatGPT官方账号的推文发布了一个链接 time-machine.openai.chatgpt-team.site,该域名并非OpenAI官方域名。此类链接可能用于钓鱼或恶意活动,用户应避免点击。推文互动数据显示仅1条回复,无转发。行业ChatGPT网络安全钓鱼网站10 个信源在谈事件专题推荐理由:别点这个伪造的OpenAI链接,是钓鱼网站。原文稍后读已读值得跟进有用关注 ChatGPT
05:46官方一手@OpenAIDevs@OpenAIDevsOpenAI发布GPT-5.6模型,社区开发者分享了超过10,000个使用该模型的理由。通过GPT-5.6,用户可以将产品从概念快速转化为成品。案例展示了GPT-5.6在代码生成和原型设计中的实际应用。AI模型GPT-5.6OpenAI编程助手10 个信源在谈事件专题推荐理由:OpenAI社区分享了用GPT-5.6开发产品的真实案例,能帮你快速把想法变成成品,效率很高。原文稍后读已读值得跟进有用关注 GPT-5.6
05:30官方账号Greg Brockman@gdb精选OpenAI 发布的 GPT-5.6 Sol 模型在网络安全任务中达到最先进水平,能够发现并修复新型漏洞。AI 安全研究所的评测显示,在名为“The Last Ones”的网络安全测试中,GLM-5.2 匹配了约 7 个月前发布的 Opus 4.5,而 DeepSeek 的 V4-Pro 低于约 7 个月前发布的 Sonnet 4.5。该模型目前面向防守方开放注册,用于保护系统。AI模型GPT-5.6 SolOpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 专攻网络安全,能找漏洞并修复,防守方现在就能注册用。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
05:18官方账号OpenAI@OpenAIOpenAI在推特上宣布GPT-5.6 Sol模型,声称用户有10000个理由喜爱它。该模型通过switch-to-codex.openai.chatgpt.site可访问。目前尚未公开基准测试结果或具体改进细节。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI刚发了GPT-5.6 Sol,号称一万人说好,去那个链接看看它到底强在哪。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
03:54@koltregaskes@koltregaskes73°谷歌 Gemini 3.5 Pro 发布再次推迟,已落后于原定6月的目标。公司为提升编码性能更新训练数据但效果不佳,目前与合作伙伴测试但未公布新日期。内部工程师和研究人员因担忧 Anthropic 的 Claude、OpenAI 的 GPT-5 等竞争者领先而感到沮丧。延迟部分源于谷歌内部多部门(搜索、地图、YouTube)协调需求。竞争对手 Grok 4.5、Meta Muse Spark 1.1 和 Kimi K3 上周均已发布,并在关键编码和智能体基准上超越 Gemini 3.1 Pro。行业Gemini 3.5 ProGoogleAnthropic10 个信源在谈事件专题推荐理由:谷歌的Gemini 3.5 Pro又跳票了,内部还挺内耗。竞争对手都发了新模型,这瓜值得吃。原文稍后读已读值得跟进有用关注 Gemini 3.5 Pro
03:39官方账号Decoder@Matthias BastianGPT-5.6 的“完全访问模式”存在漏洞,模型会错误地覆盖临时目录变量,导致自动执行删除操作。多个用户报告其整个主目录被清空。OpenAI 表示该行为不应发生,并承诺增加额外安全措施并发布详细的事后分析报告。行业GPT-5.6OpenAI文件删除10 个信源在谈事件专题推荐理由:GPT-5.6 出了个大bug,在完全访问模式下会自动删除用户文件,OpenAI 正在补救,别急着开全权限。原文稍后读已读值得跟进有用关注 GPT-5.6
01:30宝玉@dotey73°OpenAI证实GPT-5.6在执行编程任务时,可能因用户开启Codex完全访问模式并关闭沙盒保护和自动审查,从而误删整个$HOME目录。模型试图重写$HOME环境变量指定临时目录时出错。OpenAI正在更新开发者提示、引导更安全权限模式,并在Codex Harness添加安全检查。Tibo承诺几天内发布详细事后分析报告。行业GPT-5.6OpenAICodex10 个信源在谈事件专题推荐理由:OpenAI回应了GPT-5.6删文件事件,告诉你原因:关掉沙盒和自动审查就会出这种问题。如果你在用Codex,最好开启沙盒和自动审查。原文稍后读已读值得跟进有用关注 GPT-5.6
00:57官方账号Simon Willison@simonwSimon Willison指出,AI实验室的竞争优势在于明确说明是否及如何利用用户数据训练模型。他密切关注各实验室政策,但仍无法自信总结任何主流实验室(如OpenAI、Google、Meta等)的相关政策。这一观点反映了行业在数据使用透明度上的普遍问题,可能影响用户信任与合规性。行业数据政策AI安全Simon Willison10 个信源在谈事件专题推荐理由:Simon Willison点出了一个关键问题:AI公司对数据使用的政策不透明,这可能是未来竞争的分水岭。原文稍后读已读值得跟进有用关注 数据政策
00:25elvis@omarsar0Gavin Baker指出,Kimi K3可能成为AI的重要转折点。Kimi K3推理成本比GPT 5.6高50-70%(Artificial Analysis),且token效率低,每个任务的实际成本高于GPT 5.6和Grok 4.5。开源模型需要相同算力运行,但会降低模型层利润率,利好基础设施和应用层。这一趋势可能对Anthropic和OpenAI不利,但对其他公司是净正面。行业Kimi K3GPT 5.6Grok 4.510 个信源在谈事件专题推荐理由:Gavin Baker说Kimi K3可能改变AI格局,开源模型会让推理更便宜,对大部分公司利好。原文稍后读已读值得跟进有用关注 Kimi K3
21:44官方一手OpenAI Blog(博客/媒体)精选OpenAI首席财务官Sarah Friar介绍了AI记分卡,通过四个指标衡量AI投资回报:有用工作(排除无用输出)、每成功任务成本(仅计实际解决问题次数)、可靠性(任务完成率)、计算回报(单位计算资源产出)。该框架旨在帮企业避免被速度或流行度误导,聚焦实际经济价值。AI产品OpenAIAI记分卡ROI10 个信源在谈事件专题推荐理由:OpenAI的CFO教你算AI投入产出,不光看快慢,还看可靠性、成本、真干活的效果,比那些虚的指标实在多了。原文稍后读已读值得跟进有用关注 OpenAI
20:30IT之家(博客/媒体)Anthropic 在2026年7月10日推出了一支90秒宣传短片,并在世界杯四分之一决赛期间播放。短片画面包括房屋燃烧、面部识别监控、流浪者、墓碑等,配合旁白提出“AI能被信任吗”等问题。OpenAI CEO 山姆·奥尔特曼表示“还以为这是什么讽刺作品”,并检查了账号真伪。Anthropic 称该广告收集了全球超12万人的真实疑问,启动“Hard Questions”项目追踪回应。行业AnthropicOpenAISam Altman10 个信源在谈事件专题推荐理由:Anthropic 发了一支画风压抑的广告,OpenAI 的老板都以为是在恶搞,建议看看两边怎么杠上的。原文稍后读已读值得跟进有用关注 Anthropic
19:26The Rundown AI@therundownai开源模型Kimi K3发布,声称缩小了与前沿模型的差距。OpenAI推出GPT-Live功能,可用于快速规划旅行。Google的AI升级因性能问题被延迟。另有4款新AI工具和社区工作流更新。行业Kimi K3GPT-LiveOpenAI10 个信源在谈事件专题推荐理由:想快速了解今天AI圈发生了什么?Kimi K3开源追上了前沿,GPT-Live能做旅行规划,Google升级翻车,还有一堆新工具。原文稍后读已读值得跟进有用关注 Kimi K3
19:17IT之家(博客/媒体)71°苹果近日向约40名目前在OpenAI任职的前苹果员工发出法律警告,要求保存相关文件,这是苹果7月10日提交商业秘密诉讼后的新动作。诉状指控OpenAI通过招募前苹果员工获取未发布产品、零部件等商业机密,涉及两位前员工:OpenAI首席硬件官Tang Tan(在苹果任职24年)和前苹果系统电气工程师Chang Liu。苹果称已有超过400名前员工在OpenAI工作,并要求法院禁令停止OpenAI使用苹果信息。OpenAI回应称没有发现证据表明投诉有依据。行业苹果OpenAI商业秘密10 个信源在谈事件专题推荐理由:苹果和OpenAI的官司越闹越大,这次直接向40名前员工发律师函,涉及挖角、窃密和硬件布局。原文稍后读已读值得跟进有用关注 苹果
17:23Ate-a-Pi@svpinoHumane和Rabbit R1等AI硬件产品被评论为烟雾弹。Jony Ive与OpenAI合作一年多仍未推出设备。现在有团队提出一个新方向:上下文感知硬件接口,从AI优先角度设计。其形态类似已停产的Mac触控板,但具体实现未知。行业HumaneRabbit R1Jony Ive10 个信源在谈事件专题推荐理由:这篇推文点出了AI硬件连续翻车的历史,又提到了一个真正从AI出发的新设计思路,值得关注后续。原文稍后读已读值得跟进有用关注 Humane
12:09官方一手歸藏(guizang.ai)@op7418Codex 昨晚更新了交互界面,左上角切换从 Work 和 Codex 改为 ChatGPT 和 Codex。ChatGPT 的历史聊天全部整合进左边“最近聊天”栏,支持筛选普通聊天或 ChatGPT Work 任务。顶部导航新增 Chat 和 Work 两个 Tab,与网页版和移动端逻辑一致。AI产品CodexChatGPTOpenAI10 个信源在谈事件专题推荐理由:Codex 这次更新终于把聊天历史统一了,左上角直接切 ChatGPT 和 Codex,用起来顺手多了。原文稍后读已读值得跟进有用关注 Codex
09:31官方一手arXiv: OpenAI@Amir Bralin, N. Sanjay Rebello研究团队评估了OpenAI的o4-mini模型在Halliday和Resnick的《物理学基础》习题上的表现。整体准确率约90%,但文本问题准确率高达96%,而需要图文协调的问题仅79%。问题难度从低到高时,准确率显著下降。结果表明,当前最强推理模型能解答大部分标准物理题,但表现受模态和难度制约。AI模型o4-miniOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI的o4-mini做大学物理题整体准,但看图题就露馅了,准确率从96%掉到79%。原文稍后读已读值得跟进有用关注 o4-mini
07:20Gary Marcus@GaryMarcusGary Marcus 指出 AI 推理成本正经历有史以来最陡峭的商品曲线。他引用数据,中国模型每百万 token 仅需 $0.50,比 Anthropic 的 $56 便宜 112 倍。相比之下,石油价格压缩用了 40 年,半导体用了 20 年,而 AI 推理仅用数月。Anthropic 和 OpenAI 的定价分别为 $56 和 $26,远高于 Meta 的 $1.50、xAI 和 Google 的 $1。行业Gary MarcusAnthropicOpenAI10 个信源在谈事件专题推荐理由:Gary Marcus 用数据告诉你,AI 推理价格一年内垮塌到原来的百分之一,中国模型成本只有 Anthropic 的零头,这对整个行业都是改变游戏规则的事。原文稍后读已读值得跟进有用关注 Gary Marcus
07:19官方账号Greg Brockman@gdb精选GPT-5.6 Sol Pro在prinzbench上取得91/99的成绩,基本饱和该基准。该基准包含两道从未被任何模型解出的问题(各值3分),排除后模型正确回答了93题中的91题。相比GPT-5.4 Pro的79/99和GPT-5.5 Pro的82/99有明显提升。prinzbench于2026年1月发布,仅5个月后被GPT-5.6 Sol Pro饱和,加速趋势显著。AI模型GPT-5.6 Sol ProprinzbenchOpenAI10 个信源在谈事件专题推荐理由:GPT-5.6 Sol Pro把prinzbench刷到91分,比前代高出一截,连从未解出的题都快能答了,基准加速饱和太明显。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol Pro