04:52官方一手marktechpost@Michal Sutter81°OpenAI于2026年7月9日推出GPT-5.6,包含Sol、Terra、Luna三个档次。Sol定价为$5/$30每百万输入/输出token,在Artificial Analysis Coding Agent Index上以80分领先Claude Fable 5达2.8分,并在OSWorld 2.0上达到62.6%,比Opus 4.8少用85%输出token。新功能Programmatic Tool Calling在隔离V8运行时执行JavaScript,减少Clio 38%的prompt tokens和PlayCo 63.5%的总tokens。但Claude Fable 5仍在Artificial Analysis Intelligence Index、GDPval-AA v2和Toolathlon上领先,Mythos 5在SWE-Bench Pro领先约15分。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI出了三个价位的GPT-5.6,最贵的Sol编程跑分居然超了Claude Fable 5,还加了省token的自动调用工具功能,想比差距的可以看看原文稍后读已读值得跟进有用关注 GPT-5.6
04:37官方账号OpenAI@OpenAI数学家 Bartosz (@nasqret) 借助 OpenAI 的 GPT-5.6 模型,成功解决了此前被认为无法求解的数学问题。这展示了 GPT-5.6 在复杂推理和数学证明方面的能力。该案例由 OpenAI 官方在 Twitter 上发布,引发社区对模型潜力的讨论。AI模型GPT-5.6OpenAI推理模型10 个信源在谈事件专题推荐理由:数学家 Bartosz 用 GPT-5.6 解开了过去无人能解的数学题,看看这代模型推理能力有多强。原文稍后读已读值得跟进有用关注 GPT-5.6
04:36官方账号OpenAI@OpenAI西兰花农场主Hiroki使用GPT-5.6管理农场运营,包括种植规划和市场分析。该案例由OpenAI在X平台分享,展示了GPT-5.6在农业中的应用。AI帮助农民提高效率,减少人工决策成本。这标志着大型语言模型进入垂直行业场景。AI产品GPT-5.6OpenAIHiroki10 个信源在谈事件专题推荐理由:OpenAI分享了一个真实故事,日本农民用GPT-5.6种西兰花,比如规划种植和卖菜,这比单纯聊天实用多了。原文稍后读已读值得跟进有用关注 GPT-5.6
04:35官方账号OpenAI@OpenAIOpenAI分享的案例显示,Wishingrad一家使用GPT-5.6模型从自家餐厅运营麦片业务。GPT-5.6负责销售、库存管理和客户服务等环节。该家庭展示了生成式AI在小型餐饮企业中的落地场景。行业GPT-5.6OpenAIAI商业应用10 个信源在谈事件专题推荐理由:OpenAI发了个视频,一家子用GPT-5.6在自家餐厅卖麦片,看着挺有意思,可以看看AI怎么帮小生意。原文稍后读已读值得跟进有用关注 GPT-5.6
04:34官方一手@OpenAIDevs@OpenAIDevsOpenAI 为 Computer Use 功能带来重大更新,基于 GPT-5.6 模型。新版本在速度上得到提升,token 效率更高,并支持批量处理和跨多步骤任务的并行操作。新增画中画体验,方便用户后台监督智能体工作。该功能可让用户的“宠物”一起参与。AI产品GPT-5.6Computer UseOpenAI10 个信源在谈事件专题推荐理由:OpenAI 给 Computer Use 狠狠升级了一波,GPT-5.6 加持下更快更省 token,还能并行做多步任务,画中画看着就很方便。原文稍后读已读值得跟进有用关注 GPT-5.6
04:14官方账号Nous Research@NousResearchNousResearch 宣布 GPT-5.6 现已集成到 Hermes Agent 中。用户可以通过 Nous Portal 直接使用该模型。Hermes Agent 是一个支持多模型的智能体框架,此次更新扩展了 GPT-5.6 在自主任务中的应用。AI模型GPT-5.6Hermes AgentNousResearch推荐理由:如果想用 GPT-5.6 跑 Agent 任务,现在直接通过 Nous Portal 在 Hermes Agent 里调用就行,省去自己部署的麻烦。原文稍后读已读值得跟进有用关注 GPT-5.6
04:13mem0@mem0ai精选openmemory v2 是一个开源CLI工具,支持开发者在 Claude Code、Codex 和 OpenCode 之间迁移编码会话。用户可在不丢失上下文的情况下测试 GPT-5.6。该工具解决了开发者被单一模型锁定的问题。Mem0 在 X 上宣布了该版本,并邀请用户试用。AI产品openmemoryMem0Claude推荐理由:Mem0 出了个 openmemory v2,开源 CLI,能让你在 Claude、Codex 和 OpenCode 之间搬编码聊天记录,想尝鲜 GPT-5.6 又不想丢进度?用它就行。原文稍后读已读值得跟进有用关注 openmemory
04:00官方一手OpenAI Blog(博客/媒体)OpenAI 推出 GPT-5.6,并指定其为 Microsoft 365 Copilot 的首选模型。该模型在 Word、Excel、PowerPoint、Chat 和 Cowork 中提供更强的 AI 支持,能更快生成文档、分析数据。相比前代,GPT-5.6 在多项任务上提升了响应速度和质量。用户无需额外配置即可在 Copilot 中直接使用。AI模型GPT-5.6Microsoft 365 CopilotOpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 已经内嵌到 Office 全家桶里了,写文档做表格更快,用 Copilot 的话值得了解。原文稍后读已读值得跟进有用关注 GPT-5.6
03:50宝玉@dotey88°OpenAI今天发布GPT-5.6系列模型,包括旗舰Sol、性价比Terra和轻量Luna。Sol新增max和ultra推理档位,ultra可调用多个子智能体并行处理任务。ChatGPT与Codex合并为统一桌面应用,Codex周活500万,其中超100万非开发者使用其写报告和分析。ChatGPT Work功能可连接Google Drive、Slack等工具,自动拆解任务并跨应用执行,支持定时任务。另外,Sites功能可将对话中的可视化内容一键转为可分享网站,Codex新增从Claude Code迁移导入功能。AI产品OpenAIGPT-5.6ChatGPT10 个信源在谈事件专题推荐理由:OpenAI一口气发了GPT-5.6三个版本、合体桌面应用和能跨应用干活的Work模式。Sol旗舰能调用多Agent并行推理,Work自动写方案做分析,开发者还能一键从Claude Code迁移,值得试试。原文稍后读已读值得跟进有用关注 OpenAI
03:49官方账号Simon Willison’s Weblog(博客/媒体)82°OpenAI发布GPT-5.6三款模型Luna、Terra、Sol,定价分别为每百万token $1/$6、$2.50/$15、$5/$30。在Agents' Last Exam基准上,Sol以53.6分领先Claude Fable 5(自适应推理)13.1分,Terra和Luna以约1/16成本超越Fable 5。但在SWE-Bench Pro上Fable 5得80%,Sol仅64.6%。OpenAI近期发文质疑该基准约30%任务存在问题。新API支持程序化工具调用、多智能体协作和显式提示缓存断点。AI模型GPT-5.6OpenAIClaude Fable 510 个信源在谈事件专题推荐理由:GPT-5.6家族上线:Luna平价,Sol推理强,但真实编码表现不及Claude Fable 5,且新增多智能体API。原文稍后读已读值得跟进有用关注 GPT-5.6
03:48Jerry Liu@jerryjliu083°OpenAI推出了ChatGPT Work,一个由Codex和GPT-5.6驱动的新agent。该agent能够跨应用和文件执行操作,并可保持专注数小时以完成复杂目标。它将用户的目标直接转化为成品输出,无需用户手动切换工具。这被观察者视为对标Claude Cowork和Claude Code的产品。AI产品ChatGPT WorkCodexGPT-5.610 个信源在谈事件专题推荐理由:OpenAI刚出了ChatGPT Work,能跨应用持续干活,比之前的单任务模式灵活多了。原文稍后读已读值得跟进有用关注 ChatGPT Work
03:36OpenRouter@OpenRouterAIOpenRouter 已上线 GPT-5.6 模型,提供三个版本:旗舰版 Sol、均衡版 Terra 和快速低成本版 Luna。早期测试显示,GPT-5.6 的 token 效率更高,能降低使用成本并加快任务完成速度。AA 的测试结果也验证了这一点。AI模型GPT-5.6OpenRouterSol推荐理由:OpenRouter 上新了 GPT-5.6,三个版本可选,Sol 旗舰、Luna 便宜,实测更省 token 更快。原文稍后读已读值得跟进有用关注 GPT-5.6
03:33宝玉@dotey83°OpenAI 发布了 GPT-5.6 系列模型(Sol, Terra, Luna),已开始在 ChatGPT、Codex 和 API 中推出。此次合并将 ChatGPT 和 Codex 统一为一个名称。新模型家族包含三个变体,针对不同场景优化。AI模型GPT-5.6ChatGPTCodex10 个信源在谈事件专题推荐理由:OpenAI 把 ChatGPT 和 Codex 合并了,还出了 GPT-5.6 三个新模型,Sol、Terra、Luna 各有侧重,快去试试。原文稍后读已读值得跟进有用关注 GPT-5.6
03:29lmarena.ai@lmarena_aiOpenAI 在 arena.ai 上开放了 GPT-5.6 的 Battle Mode 和 Agent Mode 测试入口。用户可以直接体验模型在对抗场景和智能体任务中的表现。官方表示后续会公布评测分数。AI模型GPT-5.6OpenAI智能体10 个信源在谈事件专题推荐理由:想试试 GPT-5.6 的新模式吗?现在就能去 arena.ai 玩 Battle Mode 和 Agent Mode,体验还在热乎的测试版。原文稍后读已读值得跟进有用关注 GPT-5.6
03:24官方账号Greg Brockman@gdb精选OpenAI 发布 ChatGPT Work,这是一个由 Codex 和 GPT-5.6 驱动的智能体。它能跨应用和文件执行操作,可连续工作数小时,将用户目标转化为成品。该智能体支持移动端、网页端和桌面端使用,无需保持笔记本电脑常开。AI产品ChatGPT WorkOpenAICodex10 个信源在谈事件专题推荐理由:OpenAI 把 ChatGPT 和 Codex 合成了新智能体,能跨应用干活、连续工作几小时,做复杂项目不用守着电脑了。原文稍后读已读值得跟进有用关注 ChatGPT Work
03:23官方一手@OpenAIDevs@OpenAIDevs86°OpenAI宣布将Codex和ChatGPT合并到同一桌面应用,推出ChatGPT Work,一个由Codex和GPT-5.6驱动的新agent。它能跨应用和文件执行操作,可连续工作数小时,将目标转化为完成的工作。同时发布新Chrome扩展、改进应用内浏览器,以及由GPT-5.6加速的Computer Use功能。AI产品OpenAICodexChatGPT10 个信源在谈事件专题推荐理由:OpenAI把Codex编程agent和ChatGPT整合成一个桌面应用,新出的ChatGPT Work能帮你跨文件和应用干活,还带Chrome扩展和更快的电脑操控。原文稍后读已读值得跟进有用关注 OpenAI
03:22lmarena.ai@lmarena_ai93°OpenAI 推出的 GPT-5.6 系列包含 Sol、Terra 和 Luna 三个模型,已登陆 Agent Arena、ChatGPT、Codex 和 API。Agent Arena 在数百万真实世界长程智能体任务上评测模型,支持网页搜索、文件系统和终端工具。Leaderboard 采用因果追踪方法衡量模型输出相对于平均模型的效果。Sol 还额外支持搜索功能。用户投票将驱动排名更新。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI 把 GPT-5.6 三兄弟 Sol、Terra 和 Luna 放到 Agent Arena 里了,能跑真实世界智能体任务,还能用网络和终端工具,去投个票就能影响排行榜。原文稍后读已读值得跟进有用关注 GPT-5.6
03:19官方一手@OpenAIDevs@OpenAIDevs精选Vercel 软件主管 Andrew Qu 使用 OpenAI 的 GPT-5.6 和 Codex 解除了内部数据科学代理在先前模型卡住的任务。该代理此前在处理某些复杂工作时因模型能力不足而停滞。GPT-5.6 的推理能力使其能够继续推进这些任务。AI模型GPT-5.6CodexVercel10 个信源在谈事件专题推荐理由:Vercel 用 GPT-5.6 让数据科学代理更聪明,之前卡住的任务现在能搞定了。原文稍后读已读值得跟进有用关注 GPT-5.6
03:15coderabbitai@coderabbitaiCodeRabbit测试了GPT-5.6的两个变体Sol和Terra。Sol在遵循长任务、保持仓库上下文和代码审查基准中展现了更好的召回。Terra作为更便宜的选项适用于小范围工作。报告对比了Fable 5和Opus 4.8的定价与性能。AI模型GPT-5.6CodeRabbit编码代理推荐理由:CodeRabbit实测了GPT-5.6的两个版本,Sol在代码审查中召回更强,Terra则更省钱。对比Fable 5和Opus 4.8,想升级编码工具可以看。原文稍后读已读值得跟进有用关注 GPT-5.6
03:14AI Engineer@aiDotEngineerOpenAI 推出了 GPT-5.6 模型,包含 Sol、Terra 和 Luna 三个版本。@romainhuet、@embirico 和 @steipete 在视频中称这是 AI 工程黄金时代的开端。该推文获得 15 次点赞和 4067 次浏览。具体性能细节请查看视频。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 一口气发了三个版本,还有行业大佬站台,快去看视频了解吧!原文稍后读已读值得跟进有用关注 GPT-5.6
03:12官方账号Cursor@cursor_aiCursor 发布了 GPT-5.6 的三个变体 Sol、Terra 和 Luna。在 CursorBench 基准测试中,Sol 取得 67.2% 的分数。这些模型现已可在 Cursor 中直接使用。AI产品GPT-5.6CursorSol5 个信源在谈事件专题推荐理由:Cursor 上了新模型 GPT-5.6 Sol,编程助手又强了一截,想试试在代码场景下 67.2% 的效果吗?原文稍后读已读值得跟进有用关注 GPT-5.6
03:09The Rundown AI@therundownai91°OpenAI 发布了三个 GPT-5.6 模型:Sol、Terra 和 Luna。Sol 在 Artificial Analysis Intelligence Index 上略低于 Anthropic 的 Fable,但在多个 agentic coding 基准上超越 Fable。模型定价与 GPT-5.5 相同,远低于 Fable 的成本。同时推出了由 5.6 Sol 驱动的 agent ChatGPT Work,可跨应用和文件工作并内置 Codex。还发布了新 ChatGPT Desktop App(集成 Codex 和浏览器)以及 Hosted Sites 公开测试版。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 一口气发了三个 GPT-5.6 模型,编程更强的 Sol 比 Fable 便宜,还出了个能跨应用干活的 agent 和桌面应用,开发者快去体验。原文稍后读已读值得跟进有用关注 GPT-5.6
03:07官方一手@OpenAIDevs@OpenAIDevs91°OpenAI 发布 GPT-5.6,分为三个模型层级:Sol 用于长周期编程与智能体任务,Terra 平衡日常任务性能与成本,Luna 专注高速高频任务。在知识工作评估中,GPT-5.6 Terra 超越 GPT-5.5 且成本更低。GPT-5.6 Luna 接近 GPT-5.5 峰值性能,但 API 成本不到一半。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 给 GPT-5.6 分了三个档,Sol 专攻复杂编程和智能体任务,Terra 比上一代更强更便宜,Luna 跑得快还省一半钱。原文稍后读已读值得跟进有用关注 GPT-5.6
03:06官方一手@OpenAIDevs@OpenAIDevsOpenAI Devs展示了工程师Sam Kronick使用GPT-5.6从自然语言规范端到端构建一个完整服务的案例。该服务完全基于口语描述生成,无需手写代码。此举展示了GPT-5.6在代码生成方面的能力。具体实现流程未公开,但演示了从语音到可运行服务的完整链路。AI模型GPT-5.6OpenAI编程助手10 个信源在谈事件专题推荐理由:看OpenAI工程师怎么用GPT-5.6,光靠嘴巴说就把整个服务写出来了,比传统编程快太多。原文稍后读已读值得跟进有用关注 GPT-5.6
02:58GitHub@github86°OpenAI 发布 GPT-5.6 系列,包含三个变体:Sol、Terra 和 Luna。Sol 拥有最高推理上限,适合复杂代码库推理和长时间代理任务。Terra 是平衡默认选项,适合日常交互和代理编码。Luna 是轻量低成本变体,适合快速小任务。该系列已在 GitHub Copilot 中逐步推出。AI模型GPT-5.6OpenAIGitHub Copilot10 个信源在谈事件专题推荐理由:GitHub Copilot 现在能用 GPT-5.6 了,分三个版本:Sol 专治复杂推理,Terra 日常够用,Luna 省成本又好使。原文稍后读已读值得跟进有用关注 GPT-5.6
02:52官方一手@OpenAIDevs@OpenAIDevsOpenAI在API中推出GPT-5.6系列,包含三个模型。旗舰模型Sol在编程、知识工作、网络安全和科学领域领先。Terra以较低成本提供与GPT-5.5相当的性能。Luna是最快、最便宜的模型,适合高流量任务。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI刚发了GPT-5.6的三个新模型:Sol旗舰强在编程和科学,Terra性价比高,Luna又快又便宜。原文稍后读已读值得跟进有用关注 GPT-5.6
02:46Lovable@lovable_dev精选Lovable 宣布集成 OpenAI 的 GPT-5.6 模型。相比此前模型,GPT-5.6 在构建生产级应用的长复杂工作流中,步骤减少约 25%,工具调用次数降低 35% 至 48%。项目成功率有所提升,卡住运行的几率降低 15%。AI模型GPT-5.6Lovable编程助手10 个信源在谈事件专题推荐理由:Lovable 上了 GPT-5.6,跑复杂项目更快了,步数省四分之一,工具调用少四成,卡壳也少了,效率党可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6
02:44官方账号OpenAI@OpenAI (@OpenAI)GPT‑5.6 改进了演示文稿、文档和电子表格中工件的生成质量。新版本更好地适配用户模板,提升对齐与格式效果。这些可编辑的工件可直接导出到常用专业工具中,融入企业工作流。AI模型GPT-5.6OpenAI文档生成10 个信源在谈事件专题推荐理由:OpenAI 的 GPT‑5.6 改善了演示文稿、文档和表格里的内容生成,支持模板和导出到专业工具,办公更方便。原文稍后读已读值得跟进有用关注 GPT-5.6
02:42官方账号OpenAI@OpenAI (@OpenAI)93°OpenAI 今日发布 GPT-5.6,面向 ChatGPT、Codex 和 OpenAI API 用户。Plus、Pro、Business 和 Enterprise 用户可通过中等和高努力设置使用 GPT-5.6 Sol。Pro 和 Enterprise 用户还可选择 GPT-5.6 Pro 处理复杂任务。全球逐步推出,计划 24 小时内全量可用。AI模型GPT-5.6OpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6,有 Sol 和 Pro 两个版本,Pro 用户能选最强档,现在就能在 ChatGPT 和 API 上用。原文稍后读已读值得跟进有用关注 GPT-5.6
02:35官方账号OpenAI@OpenAIOpenAI宣布ChatGPT Work由GPT-5.6模型驱动。GPT-5.6使ChatGPT在复杂任务推理上达到最先进水平。它还能根据用户模板、参考文件和偏好风格自动生成材料。用户只需描述期望结果,无需逐步说明步骤。AI模型GPT-5.6OpenAIChatGPT Work10 个信源在谈事件专题推荐理由:OpenAI给ChatGPT Work换上了GPT-5.6,推理和按模板生成都变强了,不用一步步教它怎么做。原文稍后读已读值得跟进有用关注 GPT-5.6
02:34官方账号OpenAI@OpenAI72°OpenAI 发布了 ChatGPT Work,一个基于 Codex 和 GPT-5.6 模型构建的新 agent。它能够跨多个应用和文件执行操作,并可持续数小时跟踪项目,将用户目标转化为完成的工作。该 agent 旨在提供一种全新的工作方式,无需用户频繁切换工具。AI产品ChatGPT WorkCodexGPT-5.610 个信源在谈事件专题推荐理由:OpenAI 新出的 ChatGPT Work 能直接操控你的应用和文件,还能连续干几小时的活,效率飞起。原文稍后读已读值得跟进有用关注 ChatGPT Work
02:28官方账号Decoder@Matthias Bastian78°OpenAI将新型号GPT-5.6公开上线,并同步推出基于Codex的智能体产品ChatGPT Work。该智能体能独立处理跨Google Drive、Slack、Salesforce等多个应用的复杂项目。ChatGPT Work支持网页、移动端和桌面端访问,但具体权限取决于订阅计划。AI产品GPT-5.6ChatGPT WorkOpenAI10 个信源在谈事件专题推荐理由:OpenAI发布了能自动执行整个工作流的智能体ChatGPT Work,配合新模型GPT-5.6,可以直接跨应用操作,适合想提升办公效率的人。原文稍后读已读值得跟进有用关注 GPT-5.6
02:23官方一手@OpenAIDevs@OpenAIDevs82°OpenAI 宣布 GPT-5.6 是其当前在网络安全和生物相关任务上能力最强的模型。部分 API 调用可能被阻止或暂停,以便安全系统在双用途领域(如网络安全)进行额外审查,因为防御性和攻击性活动初看相似。OpenAI 表示将根据实际使用持续调整安全措施。该发布强调了模型在敏感领域的应用风险与安全平衡。AI模型GPT-5.6OpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6,专攻网络安全和生物任务,API 调用还会被安全审查,想了解最前沿模型能力与安全权衡的可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
02:22官方一手@OpenAIDevs@OpenAIDevs83°OpenAI 在 API 中推出了 GPT-5.6 的三个变体:Sol、Terra 和 Luna。Responses API 新增了 Programmatic Tool Calling(程序化工具调用)功能,同时 Multi-agent(多智能体)功能以 beta 形式提供。开发者可以通过 API 直接使用这些新能力。该更新旨在增强模型调用外部工具和多智能体协作的灵活性。AI模型GPT-5.6OpenAIProgrammatic Tool Calling10 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6 三个版本,Sol/Terra/Luna 各有侧重,还上了程序化工具调用和多智能体 beta,搞 Agent 的赶紧摸摸。原文稍后读已读值得跟进有用关注 GPT-5.6
02:02Cognition@cognition_labsCognition 宣布 GPT-5.6 系列已在 Devin 中可用。在 FontierCode 1.1 Extended 基准上,GPT-5.6 系列实现了强得分与成本效率的平衡。其中 GPT 5.6 Sol 达到顶级性能,成本仅为次优模型的一半。该更新旨在提升 Devin 的编码任务表现。AI模型GPT-5.6DevinFontierCode推荐理由:Devin 现在能用 GPT-5.6 了,尤其是 Sol 版本,跑分高还省一半钱,做编码任务更划算。原文稍后读已读值得跟进有用关注 GPT-5.6
01:47官方账号OpenAI@OpenAI91°OpenAI推出了GPT-5.6系列模型。该系列包含三个子模型:Sol、Terra和Luna。这些模型已开始在ChatGPT、Codex和API中逐步推出。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI出了GPT-5.6系列,Sol、Terra、Luna三个模型现在就能在ChatGPT和API里用了,赶紧试试有什么不一样。原文稍后读已读值得跟进有用关注 GPT-5.6
01:46elvis@omarsar0OpenAI 在活动中宣布了 GPT-5.6 模型,分为三个子版本:Sol、Terra 和 Luna。同时推出 ChatGPT Work,定位为“合作伙伴”,支持更复杂的工作任务。还发布了新的 ChatGPT 桌面版和 Hosted sites 功能,允许用户分享用 ChatGPT Work 创建的网站。AI产品GPT-5.6ChatGPT WorkOpenAI10 个信源在谈事件专题推荐理由:OpenAI 一次带来了 GPT-5.6 三个版本、ChatGPT Work 和桌面版更新,想做复杂工作的可以试试了。原文稍后读已读值得跟进有用关注 GPT-5.6
01:43Ethan Mollick@emollickGPT-5.6 正式上线后,作者公开了预览阶段的演示项目。通过单条提示词,GPT-5.6 生成了游戏“Don't Discuss Goblins”的创意、机制和图形。该游戏展现了模型在创意设计和简单编程上的能力。AI模型GPT-5.6创意生成游戏开发推荐理由:GPT-5.6 刚上线,看它只用提示词就生成了一款带图形的小游戏,创意和机制还挺聪明。原文稍后读已读值得跟进有用关注 GPT-5.6
01:42官方账号Greg Brockman@gdbOpenAI推出GPT-5.6系列模型,旗舰模型Sol在编码、知识工作、网络安全和科学任务上表现优异。Terra和Luna作为低成本变体,以更低价格和更少token消耗提供高性能。新系列在多项基准上超越前代,整体成本降低30%以上。AI模型GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:OpenAI出了GPT-5.6,Sol很强,还有便宜的Terra和Luna,编程和科学更厉害,token用得少。原文稍后读已读值得跟进有用关注 GPT-5.6
01:19elvis@omarsar0作者对GPT-5.6在编排与验证任务中的表现感到好奇。他通常使用不同的模型进行验证,并认为这种方式能带来更好的性能并减少奖励破解(reward hacking)导致的异常行为。目前尚缺乏适合这种测试时计算(test-time compute)范式的基准测试,作者通过多个实际项目来评估这些模式的效果。AI模型GPT-5.6OpenAI智能体10 个信源在谈事件专题推荐理由:一个开发者分享了他对GPT-5.6编排和验证的实践心得,用不同模型做验证能减少奖励破解,很实用。原文稍后读已读值得跟进有用关注 GPT-5.6