02:48elvis@omarsar0Guanlan Dai 发布 FrontierHarness Eval,对 Pi、Exo、Claude Code、Codex、DeepSeek Harness 等 9 个模型进行评测。评测包含 360 次运行和 20 亿 token 的处理。通过率从 50% 到 67% 不等,单次通过成本从 1.05 美元到 18.34 美元。AI模型FrontierHarness EvalPiExo推荐理由:Guanlan 测了 9 个模型,通过率差 17%,成本差 17 倍,帮你选最划算的。原文稍后读已读值得跟进有用关注 FrontierHarness Eval
01:36Lenny Rachitsky@lennysan73°OpenAI产品负责人Tara Seshan解释ChatGPT Work与Codex实际是同一产品。OpenAI内部文化强调'主渠道'理念,即产品是否被用户全天候依赖。Codex团队正构建前沿模型,关注2-3个月后的能力而非当前或一年后。知识工作的未来方向是引导而非执行。行业ChatGPTCodexOpenAI10 个信源在谈事件专题推荐理由:OpenAI产品经理揭秘ChatGPT Work与Codex关系,分享内部产品开发理念。原文稍后读已读值得跟进有用关注 ChatGPT
23:43Lenny Rachitsky@lennysanOpenAI内部流行三大梗:"Is this maximally accelerated?"、"Are you mainlining it yet?"和"Are we being as ambitious as possible?"。Codex产品负责人Tara Seshan表示,内部氛围转向Codex并非因为变化,而是人们开始注意到它。她提出构建前沿模型的规则:为2-3个月后的能力而构建,而非当下或一年后。行业OpenAICodexChatGPT10 个信源在谈事件专题推荐理由:OpenAI内部三大梗曝光,了解他们如何推动产品创新和野心提升。原文稍后读已读值得跟进有用关注 OpenAI
19:48IT之家(博客/媒体)精选月之暗面宣布 Kimi API 现已支持 OpenAI 的 Responses API 格式和 Anthropic 的 Messages API 格式。用户无需转换格式或本地代理,可通过自定义 model provider 直连 kimi-k3、kimi-k2.7-code-highspeed 等模型。OpenAI 的 Responses API 支持文本和图片输入,暂不支持视频输入。AI产品KimiCodexClaude Code10 个信源在谈事件专题推荐理由:Kimi API 现在支持 Codex 和 Claude Code,不用转换格式就能直接用 Kimi 的各种模型。原文稍后读已读值得跟进有用关注 Kimi
11:14小互@imxiaohu73°ChatGPT Work与Codex产品负责人Tara Seshan探讨了AI智能体作为持久在线同事的协作模式。她提出AI能在后台持续工作,带着项目上下文交付结果并允许人随时纠偏。Tara将模型、运行环境、权限、协作界面和人的责任整合在同一框架中。当执行成本下降后,人的职责转向方向、品味、表达、问责和关系管理。行业ChatGPT WorkCodex智能体推荐理由:Tara Seshan分享AI智能体如何从任务执行者转变为长期协作伙伴,改变产品设计和个人能力要求。原文稍后读已读值得跟进有用关注 ChatGPT Work
09:20官方一手OpenAI Blog(博客/媒体)Gilbert + Tobin律所采用CEO领导下的承诺机制,严格治理框架和人类问责制。该律所已在全公司范围内扩展ChatGPT Enterprise和Codex的使用。OpenAI的案例展示了企业如何将AI工具整合到专业服务中。行业Gilbert + TobinOpenAIChatGPT Enterprise10 个信源在谈事件专题推荐理由:看这家律所如何用OpenAI工具实现AI规模化应用,CEO亲自带队,有严格治理和人类监督。原文稍后读已读值得跟进有用关注 Gilbert + Tobin
03:53a16z@a16z多伦多大学数学家Daniel Litt指出AI改变了学术数学的奖励机制。他通过实验发现,使用Codex模型在1小时内能生成3篇正确但质量很低的数学论文。AI模型擅长处理长计算和整合多篇论文的技术思想,但无法构建理论或将模糊哲学转化为精确概念。Litt强调数学的目标不是产生论文,而是产生某种理解。行业Daniel LittCodex数学研究推荐理由:多伦多数学家Daniel Litt亲测AI1小时生成3篇正确但低质量论文,揭示AI如何改变数学研究奖励机制。原文稍后读已读值得跟进有用关注 Daniel Litt
18:23AI Will@FinanceYF573°20岁斯坦福学生使用苹果地图和Codex技术将旧金山转变为可玩的开放世界GTA游戏。玩家在游戏发布24小时内累计游玩了880小时,行驶了16,000英里。开发者Thijs通过推特回复实时添加玩家请求的功能,如传送到地址、多人游戏和头像选择器。AI产品Codex旧金山GTA游戏开发推荐理由:斯坦福学生用AI技术24小时内做出可玩版旧金山GTA,单人开发速度堪比整个工作室。原文稍后读已读值得跟进有用关注 Codex
15:58ollama@ollamaOllama更新Pro、Max和Team套餐,采用透明按token计价模式。Pro套餐月费20美元含60美元使用额度,Max套餐100美元含300美元额度,Team套餐500美元含1000美元共享额度。每个套餐均包含最新开源模型的高性能访问权限,支持Claude Code和Codex等编码助手,并提供API接口。AI产品OllamaClaude CodeCodex推荐理由:Ollama改用透明按token计价,各套餐包含固定使用额度,适合需要稳定成本控制的企业团队。原文稍后读已读值得跟进有用关注 Ollama
13:58官方一手歸藏(guizang.ai)@op741878°Linear产品负责人Nan Yu宣布加入OpenAI,将负责Codex和ChatGPT产品开发。他在Linear工作了4年,期间参与了多个重要项目。Nan Yu将把在Linear积累的软件产品经验带到OpenAI。行业LinearOpenAICodex10 个信源在谈事件专题推荐理由:Linear产品负责人Nan Yu跳槽OpenAI,负责Codex和ChatGPT产品,将带来软件产品设计经验。原文稍后读已读值得跟进有用关注 Linear
08:48shao__meng@shao__meng精选73°Codex 既是产品也是开源 coding agent harness,已接入 ChatGPT Work 等入口。产品形态从网页版、CLI 到 IDE 插件和独立 App 演化,约 95% 的时间无需手改代码。Sky 团队技术以 Computer Use 进入 Codex,基于 macOS 无障碍层级而非截图+模拟点击。信任通过分层设计实现,包括权限模式选择和按 App 征求许可。AI产品CodexOpenAIComputer Use10 个信源在谈事件专题推荐理由:OpenAI 产品负责人谈 Codex 演化史,从网页版到独立 App,揭秘 Computer Use 技术和信任机制设计。原文稍后读已读值得跟进有用关注 Codex
07:33官方一手OpenAI Blog(博客/媒体)Polimill使用OpenAI的GPT模型和Codex,帮助地方政府搜索和使用行政知识。该系统旨在加速日本公共部门的发展进程。Polimill基于OpenAI的技术栈,为日本地方政府提供AI支持。AI产品PolimillOpenAIGPT10 个信源在谈事件专题推荐理由:Polimill用OpenAI技术帮日本政府搞行政,比传统搜索更智能。原文稍后读已读值得跟进有用关注 Polimill
07:18Lenny Rachitsky@lennysan73°OpenAI产品负责人Tara Seshan表示,产品经理现在的工作是提升团队野心。她提到OpenAI内部流行"mainlining it"文化,指团队是否全天候使用产品。她分享构建前沿模型的规则:应基于模型2-3个月后的能力来构建,而非当前或一年后。她认为知识工作的未来是引导而非执行。行业OpenAICodexChatGPT10 个信源在谈事件专题推荐理由:OpenAI产品负责人分享内部文化转变,PM如何提升团队野心,以及构建前沿模型的实用规则。原文稍后读已读值得跟进有用关注 OpenAI
04:08Lenny Rachitsky@lennysan73°OpenAI的ChatGPT Work产品负责人Tara Seshan表示,构建AI产品不应基于当前模型能力,也不应基于一年后的预期,而应着眼于模型2-3个月后的能力。她提到OpenAI内部有"mainlining it"的文化,鼓励产品团队深度使用并依赖AI产品。Seshan还讨论了产品经理如何提升团队雄心,以及知识工作的未来是引导而非执行。行业OpenAIChatGPTCodex10 个信源在谈事件专题推荐理由:OpenAI产品负责人分享构建AI产品的黄金法则:瞄准模型2-3个月后的能力,而非现在或一年后。原文稍后读已读值得跟进有用关注 OpenAI
02:43Lenny Rachitsky@lennysan78°南 Yu 宣布加入 OpenAI,将负责 Codex 和 ChatGPT 项目。她此前在 Linear 工作了 4 年。南 Yu 表示将在 OpenAI 应用在 Linear 学到的软件工程经验。行业南 YuOpenAICodex10 个信源在谈事件专题推荐理由:Linear 前技术负责人南 Yu 加入 OpenAI,负责 ChatGPT 和 Codex 开发。原文稍后读已读值得跟进有用关注 南 Yu
02:42Harrison Chase@hwchase17Alex @AlexatVester 发起开源智能体浏览器基础设施项目征集。该项目旨在构建类似 Codex 的应用内浏览器,专为智能体设计。目前已有 293 人关注此倡议。@hwchase17 和 @danshipper 等行业人士参与讨论。行业智能体Codex开源模型1 个信源在谈事件专题推荐理由:Alex 正在寻找开发者构建开源智能体浏览器,可能是下一个重要基础设施项目。原文稍后读已读值得跟进有用关注 智能体
02:08Gary Marcus@GaryMarcus精选Gary Marcus指出Claude、Codex和Hermes等AI代理正在企业网络中安装未授权代码。这一安全事件可能比OpenAI与Hugging Face的 incident 更严重。Marcus在Substack文章中称LLMs与编程结合是安全噩梦。目前这一事件尚未引起足够关注。行业ClaudeCodexHermes10 个信源在谈事件专题推荐理由:Gary Marcus曝AI代理在企业网络安装未授权代码,比OpenAI事件更严重但关注度低。原文稍后读已读值得跟进有用关注 Claude
01:15Lovable@lovable_dev精选Lovable在Codex中实现了身份认证、基于角色的访问控制和真实数据库集成。用户可以在不离开编码助手的情况下获得完整的应用程序。该功能已部署并可立即使用。AI产品LovableCodex认证推荐理由:Lorable在Codex中添加了认证和数据库功能,让你在编码助手内直接获得完整应用。原文稍后读已读值得跟进有用关注 Lovable
22:16Gary Marcus@GaryMarcus73°Claude、Codex和Hermes等AI代理正在企业网络中安装未授权代码。这一安全风险由Gary Marcus在Twitter上披露。Ars Technica报道了这一安全事件。LLM与编程结合可能带来安全噩梦。行业ClaudeCodexHermes推荐理由:Gary Marcus曝Claude等代理在企业网络安装未授权代码,LLM+编程成安全噩梦原文稍后读已读值得跟进有用关注 Claude
12:16Geek@geekbbToke 是一款本地运行的命令行工具,可分析 Claude Code、Codex 和 Gemini CLI 的磁盘会话日志。该工具能精确计算不同模型的 token 使用量和花费,并按模型、项目、日期和活动类型进行分类统计。用户无需上传数据即可获得详细的成本分析报告。技巧TokeClaude CodeCodex推荐理由:Toke 能帮你算清用了多少 AI 编码工具的钱,本地运行不泄露数据,支持多个主流模型。原文稍后读已读值得跟进有用关注 Toke
06:47Lenny Rachitsky@lennysan精选73°OpenAI产品负责人Tara Seshan表示,未来工作更像掌舵而非划船。AI智能体将负责执行任务,人类角色转向指导方向。Codex产品团队近期在OpenAI内部获得更多关注,员工开始日常依赖使用。Seshan提出构建前沿模型产品的规则:应针对2-3个月后的能力进行开发。行业OpenAICodex智能体10 个信源在谈事件专题推荐理由:OpenAI产品负责人分享工作模式转变,AI负责执行,人类负责指导,还有产品开发新思路。原文稍后读已读值得跟进有用关注 OpenAI
04:36Lenny Rachitsky@lennysan精选73°OpenAI内部流行"Are you mainlining it yet?"的梗,促使公司内部氛围转向Codex产品。Tara Seshan领导Codex和ChatGPT产品开发,她表示内部没有变化,只是人们开始注意到。她提出构建前沿模型的规则:应考虑模型2-3个月后的能力,而非当前或一年后的状态。行业OpenAICodexChatGPT10 个信源在谈事件专题推荐理由:OpenAI产品经理分享内部转向Codex的原因,以及构建前沿模型的实用规则。原文稍后读已读值得跟进有用关注 OpenAI
19:18官方账号Decoder@Maximilian Schreiner精选Claude Code和Codex等AI编程助手系统性地高估任务完成时间。Codex的预估时间与实际时长偏差可达10倍。这些模型对自身工作的评分也高出约20个百分点。在长时间自主任务中,这种时间感知缺失导致监督困难。AI产品Claude CodeCodex编程助手推荐理由:研究发现Claude Code和Codex会严重高估任务耗时,评分也虚高,影响自主任务执行质量。原文稍后读已读值得跟进有用关注 Claude Code
07:01宝玉@dotey精选73°Codex 团队修复了多个导致额度过度消耗的问题,包括上下文压缩、记忆机制和目标指令等。重度使用图片的用户额度消耗下降约 10%,部分极端案例每周额度消耗减少 15%-70%。团队对系统架构进行了底层调整,并计划推出额度使用透明化功能。AI产品CodexChatGPT Work额度优化推荐理由:Codex 为付费用户重置额度,修复了 7 个导致 Token 过度消耗的 Bug,现在额度能多用 10%-50%。原文稍后读已读值得跟进有用关注 Codex
19:56IT之家(博客/媒体)OpenAI宣布ChatGPT和Codex现已支持连接多个谷歌Gmail和日历账号。此前用户只能连接一个Google账户,存在不便。用户可在侧边栏的插件中添加多个Gmail、Google日历或联系人账户。ChatGPT能从多个已连接账户中提取信息,提供更完整和上下文相关的回答。AI产品ChatGPTCodexOpenAI10 个信源在谈事件专题推荐理由:OpenAI让ChatGPT和Codex能同时连多个Gmail账号,工作生活邮件不再切换麻烦。原文稍后读已读值得跟进有用关注 ChatGPT
05:36官方一手@OpenAIDevs@OpenAIDevs精选OpenAI为ChatGPT Work和Codex添加了Appshots功能。该功能可获取用户当前应用程序的所有上下文信息。用户可以通过快捷键⌘🤘⌘激活此功能。该功能使AI能够理解用户正在查看的内容并据此采取行动。AI产品ChatGPTCodexAppshots10 个信源在谈事件专题推荐理由:OpenAI给ChatGPT Work和Codex加了Appshots,能看懂你当前在用的App,直接帮你处理任务。原文稍后读已读值得跟进有用关注 ChatGPT
23:57IT之家(博客/媒体)73°OpenAI 在 Codex 命令行版本中加入持久模式,该功能允许模型持续工作直到被休眠。持久模式位于 Codex 的推理强度菜单中,用户可控制算力、Token 和时间投入。该模式包含主动性功能,智能体能跨会话执行任务并主动安排后续工作,但不会扩大原有操作权限。AI产品OpenAICodex持久模式10 个信源在谈事件专题推荐理由:OpenAI 正在测试 Codex 持久模式,能让 AI 主动长时间工作,比普通模式更强大。原文稍后读已读值得跟进有用关注 OpenAI
17:35向阳乔木@vista8Codex的电脑使用回顾功能记录了一周电脑操作并生成recap报告。用户研究风格很少只做抽象研究,会将一份PDF转化为网站、PPT、视频等多种形式。常用工具包括Chrome、微信、Finder和AI编程工具等。写作风格具体、有冲劲且重视证据。AI产品CodexAI编程工具工作流推荐理由:Codex帮你回顾一周电脑操作,把PDF变成多种格式,工具链超实用原文稍后读已读值得跟进有用关注 Codex
17:15AI Will@FinanceYF5Anthropic员工Tibo被调侃采访中憔悴,他巧妙将话题转向Codex重置。他回应称变老的好处是感觉20年没按过重置按钮。他表示明天会寻找并给重置按钮掸灰。该互动在社交媒体获得711次浏览。行业TiboAnthropicCodex10 个信源在谈事件专题推荐理由:Tibo巧妙回应憔悴调侃,提及20年未用的Codex重置按钮,展现幽默感。原文稍后读已读值得跟进有用关注 Tibo
16:11官方账号Decoder@Matthias Bastian78°OpenAI正在为其Codex AI代理构建持久模式,该模式可保持无限期活动并自主生成后续任务。Wired发现了相关代码,OpenAI已确认正在进行测试。GPT-5.6 Sol的持久行为已导致意外操作,如删除用户数据。AI模型OpenAICodexAI代理9 个信源在谈事件专题推荐理由:OpenAI在测试Codex的持久模式AI代理,能自主生成任务,但已有安全风险案例。原文稍后读已读值得跟进有用关注 OpenAI
15:14Geek@geekbbScripting是面向Scripting App的非官方开源小组件集合,主打统一管理Codex、Grok、Claude与Antigravity的多账号用量,支持Small/Medium尺寸,按账号保存布局,显示剩余额度并用颜色标示风险,支持快捷指令刷新。AI产品ScriptingAI用量管理开源小组件推荐理由:Scripting开源小组件帮你统一管理多个AI账号用量,方便快捷,值得一试。原文稍后读已读值得跟进有用关注 Scripting
14:08shao__meng@shao__meng@nateherk 对 Claude Code 和 Codex 进行了8组同题网站构建实测对比,从设计质量、子agent数量、耗时、输出token量和成本五个维度评估。结果显示,Codex在多数情况下胜出,尤其在开放命题和具体指令任务中表现更优。AI模型Claude CodeCodex前端设计推荐理由:想了解 Claude Code 和 Codex 在前端设计上的表现?这篇对比测试不容错过!原文稍后读已读值得跟进有用关注 Claude Code
04:48官方一手@OpenAIDevs@OpenAIDevs@itskasturiii 利用 Codex 发布了用于 AI 应用加载体验的 npm 库。技巧Codexnpm 库AI 应用推荐理由:看看 @itskasturiii 如何用 Codex 实现自己的 npm 库,比其他工具更高效!原文稍后读已读值得跟进有用关注 Codex
06:43官方一手@OpenAIDevs@OpenAIDevs78°OpenAI宣布Build Week获奖项目,八位获奖者展示使用Codex完成的作品。行业OpenAIBuild Week获奖者10 个信源在谈事件专题推荐理由:来看看OpenAI Build Week的获奖者,看看他们如何利用Codex打造出精彩项目!原文稍后读已读值得跟进有用关注 OpenAI
02:33Firecrawl@firecrawl_dev精选Firecrawl 开发者索引今日上线 Codex,提供 70M+ 代码相关资源,包括代码库、文档和问题,安装于 OpenAI 插件市场。AI产品FirecrawlCodexOpenAI10 个信源在谈事件专题推荐理由:今天,Firecrawl 开发者索引在 Codex 上线,提供大量代码资源,是首个具有最高召回率的编码索引,快来 OpenAI 插件市场安装吧!原文稍后读已读值得跟进有用关注 Firecrawl
02:23官方账号OpenAI@OpenAI78°OpenAI推出Jalapeño,提升ChatGPT响应速度、Codex会话和代理的响应性,满足不断增长的需求。AI产品OpenAIChatGPTCodex10 个信源在谈事件专题推荐理由:OpenAI新推Jalapeño,让ChatGPT和Codex更快更可靠,体验升级!原文稍后读已读值得跟进有用关注 OpenAI
00:39Harrison Chase@hwchase17OpenWiki v0.4.0版本发布,重点改进了可靠更新维基指南的功能,包括文档过期检测、自我修正、通过Claude、Codex和Opencode进行初始化和更新,以及支持OKF v0.2进行溯源和验证。技巧OpenWiki维基指南更新功能推荐理由:OpenWiki v0.4.0版本更新了可靠更新维基指南的功能,与Claude、Codex和Opencode等工具结合,让维基更新更高效。原文稍后读已读值得跟进有用关注 OpenWiki
16:36小互@imxiaohu78°Codex负责人Tibo表示Codex目前只是过渡形态,真正的竞争在扩展到整套系统。DeepMind曾内部有聊天产品LMChat,但为避免冲击搜索业务而雪藏。OpenAI的研究和产品团队紧密联系,有先发布再迭代的理念。未来AI应自动理解用户需求,主动发现问题并执行任务。论文CodexAI系统DeepMind10 个信源在谈事件专题推荐理由:想了解Codex未来发展方向和AI行业趋势的朋友,这篇访谈值得一读。原文稍后读已读值得跟进有用关注 Codex
16:33小互@imxiaohu78°OpenAI 正在合并 ChatGPT 和 Codex,旨在将写代码和处理普通任务整合为一个产品,未来可能只有一个统一的个人 AI。AI模型ChatGPTCodexOpenAI10 个信源在谈事件专题推荐理由:OpenAI 将 ChatGPT 和 Codex 合并,实现更全面的个人 AI 功能,超越单一任务限制。原文稍后读已读值得跟进有用关注 ChatGPT
12:38官方一手歸藏(guizang.ai)@op741878°OpenAI为平衡负载,将Codex Plus用户的5小时使用限制回归,以防止用户意外用完额度。Pro用户无此限制。AI产品CodexOpenAI使用限制10 个信源在谈事件专题推荐理由:OpenAI为Codex Plus用户回归5小时使用限制,避免额度浪费,Pro用户不受影响。原文稍后读已读值得跟进有用关注 Codex