12:39Latent.Space@latentspacepodCodex与ChatGPT Work的活跃用户数达到800万。团队重置了所有用户的使用限制,并继续保持无5小时速率限制状态。用户现在可以自由探索GPT-5.6 Sol的极限能力。AI产品CodexChatGPT WorkGPT-5.6推荐理由:Codex和ChatGPT Work用户破800万了,取消速率限制,快去玩GPT-5.6吧!原文稍后读已读值得跟进有用关注 Codex
10:53小互@imxiaohuOpenAI宣布Codex和ChatGPT Work活跃用户数达到800万。平台对所有用户再次重置了使用限制,并继续不设5小时速率限制。用户可随意探索GPT-5.6模型的能力。AI产品CodexChatGPT WorkOpenAI10 个信源在谈事件专题推荐理由:OpenAI又给Codex和ChatGPT Work用户重置用量了,现在没5小时限制,快试试GPT-5.6吧!原文稍后读已读值得跟进有用关注 Codex
10:51宝玉@dotey82°OpenAI 的 Codex 推出了多项新功能,包括基于 GPT-5.6 的 Ultra 模式,支持更复杂的任务。新增多智能体并行协作能力,可同时处理多个子任务。Codex 现在能操作计算机和浏览器、理解应用截图、进行行内代码和文档修改。还支持一键部署 Sites、跨项目管理以及完整的 PR 工作流(从评审到合并)。这些更新使 Codex 从代码助手升级为全流程开发伙伴。AI产品CodexGPT-5.6OpenAI10 个信源在谈事件专题推荐理由:Codex 刚刚大更新,有了 GPT-5.6 Ultra 模式、多智能体协作、操作电脑和浏览器,还能一键发布网站。不是简单补全代码,而是帮你管项目、做 PR 走到底。原文稍后读已读值得跟进有用关注 Codex
09:21IT之家(博客/媒体)76°OpenAI 于 7 月 10 日上线 GPT-5.6 系列模型,涵盖 ChatGPT、Codex 和 API。上周智能体 AI 产品 Tokens 用量增长 2.5 倍。奥尔特曼称 GPT-5.6 Sol 在编程任务中与竞品相当或更好,且 Tokens 效率提高 54%。OpenAI 报告 98% 员工使用 Codex,七个月内 Codex 研究应用增长 56 倍,8 小时自主任务需求增长 10 倍。AI模型GPT-5.6OpenAICodex10 个信源在谈事件专题推荐理由:OpenAI 说 GPT-5.6 Sol 编程效率高 54%,智能体用量暴涨 2.5 倍,看看新模型有多强。原文稍后读已读值得跟进有用关注 GPT-5.6
07:41官方一手@OpenAIDevs@OpenAIDevs76°OpenAI 宣布 Codex 在两个月内完成150多项更新,周活跃用户突破700万。新功能包括 GPT-5.6 模型、Ultra Parallel 并行能力、/goal 指令、更快的计算机使用(Faster computer use)、AppShots 截图理解、内联编辑(Inline edits)、Sites 站点支持、Codex 移动端和 SSH 工作流,以及从审查到合并的 PR 流程优化。这些更新显著提升了 Codex 作为 AI 编程助手的功能范围和效率。AI产品CodexOpenAIGPT-5.610 个信源在谈事件专题推荐理由:OpenAI 的 Codex 两周内更新150多项,新增 GPT-5.6 和 Ultra Parallel,周用户破700万,编程效率又上一台阶。原文稍后读已读值得跟进有用关注 Codex
06:45官方账号Simon Willison’s Weblog(博客/媒体)Simon Willison在Codex Desktop中创建自定义宠物,使用GPT-5.6 Sol xhigh和gpt-image-2生成精灵图。他通过详细提示词生成了角色参考图、精灵表、动画GIF。项目开源,包含Apache 2.0许可的hatch-pet和imagegen技能。整个过程展示了用提示词工程生成游戏精灵的工作流。技巧Codex DesktopGPT-5.6gpt-image-2推荐理由:Simon教你用GPT-5.6和gpt-image-2在Codex里做一只骑自行车的鹈鹕宠物,连精灵图和动画都有了,代码开源可复现。原文稍后读已读值得跟进有用关注 Codex Desktop
05:57techcrunch@Julie Bort多个社交媒体帖子声称OpenAI旗舰模型GPT-5.6 Sol会在无警告情况下自行删除文件和数据。OpenAI在今年6月的一份技术文档中已基本披露该问题。目前尚未推出正式修复补丁,用户需避免授予其文件系统权限。行业GPT-5.6SolOpenAI10 个信源在谈事件专题推荐理由:别让GPT-5.6 Sol 乱删你文件!它可能无警告删除数据,OpenAI 6月就提过这事。用之前一定记得备份。原文稍后读已读值得跟进有用关注 GPT-5.6
03:33官方一手@OpenAIDevs@OpenAIDevsOpenAI开发者使用GPT-5.6从零构建了针对NotionHQ架构的模型评估命令行工具。该工具可自动化评估新模型在NotionHQ架构上的性能。这是GPT-5.6在具体工程任务中的一次实际应用展示。AI模型GPT-5.6NotionHQOpenAI10 个信源在谈事件专题推荐理由:OpenAI用GPT-5.6写了个命令行工具,专门给Notion架构跑模型评估,挺酷的原文稍后读已读值得跟进有用关注 GPT-5.6
00:55官方账号Sam Altman@samaGPT-5.6的价格是fable的一半,token效率约为fable的两倍。Sam Altman宣布该模型能以更低的成本完成相同任务。具体而言,GPT-5.6在多个场景中实现了价格减半和效率翻倍的性能提升。AI模型GPT-5.6OpenAIfable10 个信源在谈事件专题推荐理由:OpenAI发了GPT-5.6,价格比fable便宜一半,token效率高两倍,省钱又省力。原文稍后读已读值得跟进有用关注 GPT-5.6
18:12AI Will@FinanceYF5一位开发者@Angaisb_正在用GPT-5.6进行大量强化学习实验。实验尝试将涌现行为与强化学习混合。早期结果显示积极效果。AI模型GPT-5.6强化学习涌现行为推荐理由:有人正在让GPT-5.6通过强化学习变得更聪明,早期效果不错,可以关注一下。原文稍后读已读值得跟进有用关注 GPT-5.6
18:07AI Will@FinanceYF5OpenAI在5天前发布GPT-5.6。用户已展示10个富有创意的应用案例。这些案例凸显GPT-5.6的强大能力。AI模型GPT-5.6OpenAI应用案例10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6才发五天,网友就整出了10个炸裂案例,创意拉满,来看看有多夸张。原文稍后读已读值得跟进有用关注 GPT-5.6
12:39官方账号Greg Brockman@gdbOpenAI 的 GPT-5.6 系列模型(Sol、Terra、Luna)正式在 Amazon Bedrock 上全面可用。该系列提供三个智能层级,从旗舰推理(Sol)到快速推理(Luna)。基于 Bedrock 的下一代推理引擎,支持高性能、安全、规模和可靠性。开发者可直接在 AWS 上调用这三种模型。AI模型GPT-5.6OpenAIAmazon Bedrock10 个信源在谈事件专题推荐理由:OpenAI 在 Bedrock 上了 GPT-5.6 的三个档位:Sol 负责强推理,Luna 跑得快,中间 Terra 平衡。现在 AWS 用户直接用,不用折腾部署了。原文稍后读已读值得跟进有用关注 GPT-5.6
10:59岚叔@lufzzlizGoogle 计划于本周17日发布新模型 Gemini 3.5。据称在内部测试中,Gemini 3.5 性能超越 GPT-5.6 和 Fable 5。相比上一代 Gemini 3.1 Pro,新模型有显著提升。具体基准成绩未公开。AI模型Gemini 3.5GoogleGPT-5.67 个信源在谈事件专题推荐理由:Google 的新模型 Gemini 3.5 本周就要来了,内部测试居然超过了 GPT-5.6 和 Fable 5,比前代 Pro 版强不少。原文稍后读已读值得跟进有用关注 Gemini 3.5
10:36Marc Andreessen@pmarcaGPT-5.6 成功解决了 Erdős #793 问题,这是一个关于两素数集(2-primitive sets)的数论难题,已困扰数学界超过 50 年。该成果由 Jared Duker Lichtman 验证并公布。GPT-5.6 展现出在数学推理领域的强大能力。AI模型GPT-5.6推理模型数论推荐理由:GPT-5.6 又解开了一个 50 年没人能搞定的数学题,数学推理能力真的强。原文稍后读已读值得跟进有用关注 GPT-5.6
10:25elvis@omarsar0不少开发者固守单一模型提供商,如Claude用户推崇Fable 5,Codex用户推崇GPT-5.6。Elvis指出忠诚于单一提供商是糟糕策略,建议编排组合闭源与开源模型。顶级开发者已在实践这种混合模式。技巧ClaudeCodexGPT-5.6推荐理由:别只盯着一家模型,混搭Claude、Codex和开源模型效果更好,顶级大佬都在这么干。原文稍后读已读值得跟进有用关注 Claude
07:24官方账号Greg Brockman@gdbPrzemek Chojecki 发推称 GPT-5.6 Sol Ultra 找到了 Erdős 问题 #793 的一个解法。该问题涉及 2-primitive 集的渐近性质。GPT 提出的构造极短且优雅,增强了 Erdős 原本用于证明较弱结果的方法。AI模型GPT-5.6Sol Ultra推理模型推荐理由:GPT-5.6 Sol Ultra 又解了一个 Erdős 难题 #793,构造比原方法更短更优雅,数学推理让人眼前一亮。原文稍后读已读值得跟进有用关注 GPT-5.6
05:15官方一手AWS Machine Learning Blog@Tanvi Girinath73°OpenAI 正式发布 GPT-5.6 系列三个模型 Sol、Terra 和 Luna,并已在 Amazon Bedrock 上全面可用。该系列是 OpenAI 迄今最智能的模型家族,针对高性能、安全性和可靠性优化。Amazon Bedrock 提供下一代推理引擎来运行这些模型。用户无需单独部署即可通过 Bedrock 调用 GPT-5.6 系列。AI模型GPT-5.6OpenAIAmazon Bedrock10 个信源在谈事件专题推荐理由:OpenAI 最强模型 GPT-5.6 系列直接上架 AWS,现在在 Bedrock 就能用,省去自己部署的麻烦,三个版本各有特色,性能很强。原文稍后读已读值得跟进有用关注 GPT-5.6
01:40lmarena.ai@lmarena_aiGPT-5.6 Sol在Agent Arena评测中综合排名第二,整体得分提升10.9%。在可操纵性(Steerability)指标上以+17.3%位列第一。确认任务成功(Confirmed Task Success)和工具幻觉(Tool Hallucination)指标均排名第二,分别提升10.9%和1.3%。赞美与抱怨比(Praise vs. Complaint)排名第三(+17.6%),Bash恢复(Bash Recovery)排名第14(+7.5%)。AI模型GPT-5.6Agent Arena智能体推荐理由:GPT-5.6 Sol在Agent Arena里表现挺猛,可操纵性直接第一,整体第二,具体各项指标排名都有数据,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6
01:38lmarena.ai@lmarena_ai78°GPT-5.6 Sol在Agent Arena排行榜上以7800次真实世界智能体会话位列第二。相比GPT-5.5 (xHigh)净提升1.6%。与榜首Claude Fable 5的差距主要来自“表扬 vs 投诉”信号,后者得分+17.3%,GPT-5.6 Sol为+10.9%。Agent Arena基于数百万真实世界长周期任务,使用因果追踪方法评估。GPT-5.6系列(Sol, Terra, Luna)已开始在ChatGPT、Codex和API中推出。AI模型GPT-5.6OpenAIAgent Arena10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6 Sol在Agent Arena上冲到第二,比前代进步明显,和Claude Fable 5差距缩小了,想看看真实任务中模型表现的话值得关注。原文稍后读已读值得跟进有用关注 GPT-5.6
00:19官方账号Greg Brockman@gdb用户Prasenjit通过GPT-5.6 sol在Cursor中设置Blender MCP,生成了一段逼真浮动MacBook的3D渲染视频。该用户此前从未打开过Blender。成品视频在X平台获得468次点赞。整个过程展示了AI模型与Blender MCP工具的组合能力。技巧GPT-5.6CursorBlender推荐理由:看,有人用GPT-5.6和Cursor直接操作Blender MCP做3D渲染,自己没碰过Blender就搞出逼真MacBook,零基础也能玩。原文稍后读已读值得跟进有用关注 GPT-5.6
05:34官方账号Simon Willison’s Weblog(博客/媒体)Anthropic 再次延长 Claude Fable 5 的可用期限至 7 月 19 日。付费用户可在 Claude Max 计划中使用该模型,每周使用量上限的 50% 可分配给 Fable 5。同时 Claude Code 的周速率限制继续维持在 50% 的更高水平。OpenAI 对 GPT-5.6 Sol 未采取类似的访问限制。作者建议 Anthropic 永久保留 Fable 以避免用户流失。AI产品Claude Fable 5AnthropicOpenAI10 个信源在谈事件专题推荐理由:Anthropic 又把 Fable 的可用时间延到 7 月 19 日了,OpenAI 的 GPT-5.6 却无需限制,Anthropic 该考虑永久开放了。原文稍后读已读值得跟进有用关注 Claude Fable 5
08:19IT之家(博客/媒体)GPT-5.6模型上线期间,xAI CEO马斯克转发帖文称奥尔特曼把诈骗提升到新高度,并配图其曾表示“我热爱做这件事”。奥尔特曼回应马斯克炒作太空数据中心,并嘲讽马斯克对自己念念不忘。马斯克反击称明年试飞太空数据中心,并指责OpenAI窃取开源AI慈善机构技术和苹果手机技术。双方互不相让,延续了长期的口水战。行业GPT-5.6马斯克奥尔特曼10 个信源在谈事件专题推荐理由:GPT-5.6刚上线,马斯克和奥尔特曼又吵起来了。看看两位大佬互相揭短,还挺有意思的。原文稍后读已读值得跟进有用关注 GPT-5.6
07:03AI Will@FinanceYF582°据可靠来源确认,GPT-5.6已完成训练并内测两个月。OpenAI与监管机构提前协调,导致公开延迟。GPT-5.6被指比上一代token效率高54%(Sam Altman在CNBC表态),但复杂任务中实际token消耗更大。下一个广泛流传的传闻是GPT-6将在六周内预览或发布,其采用了全新预训练。这意味着前沿模型发布节奏从季度级加速到周级,但推理预算增大使计算需求超供应,能源瓶颈将更突出。AI模型GPT-5.6GPT-6OpenAI10 个信源在谈事件专题推荐理由:GPT-5.6偷偷跑了两月才公开,效率提升但更吃算力。六周内可能来GPT-6,背后是监管和算力双重卡脖子。原文稍后读已读值得跟进有用关注 GPT-5.6
01:20官方账号Sam Altman@sama83°OpenAI发布GPT-5.6系列,在医疗任务中表现优于医生。最小变体GPT-5.6 Luna在最低推理努力下即超越GPT-5.5最高推理努力,成本降低25倍。最大变体GPT-5.6 Sol创下新标杆。研究收集了患者和临床医生两类任务,由专科医生花费无限时间并联网撰写回答,再由另一些医生盲评。在20000次轴评级(准确性、沟通、完整性、指令遵循、健康决策有用性)中,所有GPT-5.6变体在完美率上显著超过医生。AI模型GPT-5.6OpenAIAI医疗10 个信源在谈事件专题推荐理由:OpenAI发了GPT-5.6,医生写回答都写不过它,成本还更低,医疗AI又进步了一大截原文稍后读已读值得跟进有用关注 GPT-5.6
23:01AI Will@FinanceYF5OpenAI 在不到 24 小时前发布了 GPT-5.6 模型。用户已开始尝试多种创新用法,并引发广泛关注。AI模型OpenAIGPT-5.6模型发布10 个信源在谈事件专题推荐理由:OpenAI 刚出了 GPT-5.6,网上已经有不少人秀各种花式玩法,快去围观。原文稍后读已读值得跟进有用关注 OpenAI
22:41AI Will@FinanceYF5精选新测试对比了 GPT-5.6(Sol Ultra、Terra Ultra、Luna Max)和 GPT-5.5 xhigh 在 4 项 canvas 动画提示上的表现。在 macOS 'hello' 手写测试中,Sol Ultra 与 5.5 并列最佳。火球入水测试中,GPT-5.5 的蒸汽和气泡效果更真实。燃烧湿纸测试里,5.5 的火焰在水边停止、湿半页焦黑的表现更准确。ChatGPT 应用 UI 测试中,5.6 三大变体均正确遵循多步指令并逐字流式输出,而 5.5 跳过了流式。结论:5.6 在指令遵循和多步协调上明显更好,但原始物理直觉仍是 5.5 更强。AI模型GPT-5.6GPT-5.5OpenAI10 个信源在谈事件专题推荐理由:想知道 GPT-5.6 哪里比 5.5 强、哪里反而弱?这篇实测用四个具体动画场景拆给你看,不吹不黑。原文稍后读已读值得跟进有用关注 GPT-5.6
18:18@hebbia@hebbiaHebbia 宣布集成 OpenAI GPT-5.6 的三个变体 Sol、Terra、Luna。这些模型现已通过 Hebbia 的界面和 API 调用。Hebbia 未具体说明三者差异,但通常不同变体针对推理速度、成本或多模态能力优化。用户可直接在 Hebbia 工作流中选用任意版本。AI产品GPT-5.6HebbiaOpenAI10 个信源在谈事件专题推荐理由:Hebbia 把 GPT-5.6 的三个新版本都接进来了,你可以按需切换 Sol、Terra 或 Luna,不用自己折腾 API。原文稍后读已读值得跟进有用关注 GPT-5.6
16:25官方账号Greg Brockman@gdbBox推出新型推理模型Sol,专为复杂推理与数据分析设计。Sol能分析数百页贷款交易文件,自动协调协议、财务、尽职调查和抵押品等材料中的条款。它会标记潜在风险点,并生成一份附带来源引用的分析报告保存至Box。该模型在文档密集型场景中大幅提升效率。AI模型SolBoxGPT-5.6推荐理由:Box出了个叫Sol的模型,能一次读几百页贷款合同,自动比对条款找出矛盾,还帮你出带引用的报告,搞数据分析爽翻了。原文稍后读已读值得跟进有用关注 Sol
14:29量子位@henryGPT-5.6 通过 700 词 Prompt 调度 64 个子 Agent,在一小时内解开了悬而未决 50 年的数学猜想。该成果展示了大型语言模型在复杂推理和协作任务上的突破,子 Agent 架构可并行处理不同子问题。研究人员称,该方法不仅适用于数学,还可推广到科学发现和工程优化。AI模型GPT-5.6推理模型智能体推荐理由:GPT-5.6 用 700 词 Prompt 指挥 64 个小模型,一小时破解了数学家 50 年没解开的难题,推理能力强到离谱。原文稍后读已读值得跟进有用关注 GPT-5.6
11:30向阳乔木@vista8vista8分享了一个方法:如果不知道用AI开发什么,除了开发解决自身痛点的小工具,还可以查看GitHub的开源公共API仓库。让Codex读取这些API,能获得产品灵感。例如,他本周分享的IMDB Top250网站就是通过这种方式从API仓库中找到灵感开发的。技巧GPT-5.6CodexGitHub推荐理由:vista8教你一个招:不知道用AI开发啥?去GitHub翻公共API仓库,让Codex读给你灵感,IMDB Top250就是这么来的。原文稍后读已读值得跟进有用关注 GPT-5.6
09:31官方账号Greg Brockman@gdbOpenAI推出GPT-5.6,重点面向健康智能领域。GPT-5.6系列在整体性能提升的同时降低了成本。其中GPT-5.6 Luna在最高推理设置下超越GPT-5.5,但成本仅为后者的1/25。该模型使更多用户能够使用先进AI。AI模型GPT-5.6GPT-5.6 LunaOpenAI10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6健康智能版来了,Luna比上一代强还便宜25倍,这波升级很实在。原文稍后读已读值得跟进有用关注 GPT-5.6
09:22SuperTechFans(博客/媒体)92°GPT-5.6 Sol 在 Agents' Last Exam 上得分 53.6,领先 Claude Fable 5 达 13.1 分。中等推理模式下仅用约四分之一成本即领先 11.4 分。Terra 和 Luna 以约十六分之一成本超越 Fable 5。在 Artificial Analysis Coding Agent Index 上 Sol 取得 80 分,领先 Fable 5 2.8 分,token 和成本大幅降低。新推出 ultra 模式默认协调四个智能体并行工作,提升浏览和证券基准表现。安全方面经过广泛红队测试和自动化评估。AI模型GPT-5.6OpenAIClaude Fable 510 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6,三个型号性能都爆表,尤其 Sol 在编码和推理测试里吊打 Claude Fable 5,成本还低很多,编程和复杂任务都更强了。原文稍后读已读值得跟进有用关注 GPT-5.6
08:03@koltregaskes@koltregaskes71°据传闻,Gemini 3.5 Pro 原定下周发布,但因检查点性能未达标而推迟数周。Google 需要大幅提升该模型,以应对 Fable 5、GPT-5.6、Grok 4.5 和 Meta Spark 等 SOTA 模型。在 Gemini 3.5 Pro 推出前,可能还会看到 GPT-6 和 Fable 5.1 等新模型。AI模型Gemini 3.5 ProGoogleFable 58 个信源在谈事件专题推荐理由:Google 的 Gemini 3.5 Pro 推迟了,对手们可没闲着,Fable 5、GPT-5.6 都在抢跑。看看这场竞赛有多激烈。原文稍后读已读值得跟进有用关注 Gemini 3.5 Pro
07:38官方一手@OpenAIDevs@OpenAIDevs89°OpenAI Build Week 将于下周一(7月13日)启动,官方举办两场直播帮助开发者上手。第一场直播在7月13日上午10点(太平洋时间),将进行黑客马拉松概述,并现场演示 Codex 和 GPT-5.6 的实际应用。参与者可从中了解如何选择构建项目。行业OpenAICodexGPT-5.610 个信源在谈事件专题推荐理由:OpenAI 要搞 Build Week 了,7月13日有直播演示 Codex 和 GPT-5.6,想参加黑客松的别错过。原文稍后读已读值得跟进有用关注 OpenAI
05:37官方账号OpenAI@OpenAIOpenAI 发布 GPT-5.6,聚焦健康智能领域。其中 GPT-5.6 Luna 在最高推理设置下性能超越 GPT-5.5。同时推理成本降低 25 倍。这些改进旨在提升模型质量并降低使用门槛,让更多人能够用上先进模型。AI模型GPT-5.6GPT-5.6 LunaOpenAI10 个信源在谈事件专题推荐理由:OpenAI 新出的 GPT-5.6 Luna 性能比 GPT-5.5 强,还便宜 25 倍,搞健康智能的可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
05:16Paul Couvert@itsPaulAi过去72小时内,OpenAI发布了GPT-5.6,SpaceXAI推出了Grok 4.5,Muse发布了Spark 1.1,Meta推出了Muse图像/视频模型,OpenAI还发布了GPT-Live,Mistral推出了Robostral Navigate。这6款新模型/产品覆盖语言、图像、导航等多个方向。AI模型GPT-5.6Grok 4.5Muse Spark 1.110 个信源在谈事件专题推荐理由:这两天AI圈太热闹了,OpenAI、SpaceXAI、Meta一口气发了6个新模型,包括GPT-5.6和Grok 4.5,值得一看。原文稍后读已读值得跟进有用关注 GPT-5.6
04:52官方账号Greg Brockman@gdbEthan Knight宣布GPT-5.6 Sol Ultra在64个子智能体协作下,仅用不到1小时就证明了50年未解的Cycle Double Cover Conjecture。该猜想是图论中的经典问题,此前无人能解。团队公开了提示词和完整证明过程,展示了大规模智能体协同推理的潜力。AI模型Sol UltraGPT-5.6智能体推荐理由:Sol Ultra刚发布就搞定了困扰数学界50年的猜想,64个AI一起发力,效率惊人。想看看提示词和证明?直接去翻原文。原文稍后读已读值得跟进有用关注 Sol Ultra
04:32官方一手@OpenAIDevs@OpenAIDevs精选GPT-5.6 在 SnorkelAI 的 Ankit Aich 测试中,独立完成了一个近 1000 行的复杂编码任务,无需反复提示或人工介入。该模型从编写到调试全程自主处理,展示了长上下文和复杂推理能力。测试结果在 OpenAI 开发者官方账号发布,获得 170 点赞和 20534 次查看。AI模型GPT-5.6OpenAI编程助手10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 能独立啃下近千行代码,不用你一步步教,编程助手又进化了。原文稍后读已读值得跟进有用关注 GPT-5.6
04:03官方账号Simon Willison@simonwGPT-5.6 提供了多种模型和推理努力等级,用户常困惑如何选择。据测试,Sol medium 在编程任务上优于 5.5 xhigh。更高的推理等级(Sol 系列)能带来更佳性能,但会快速消耗限额。开发者正在改进沟通方式。技巧GPT-5.6Sol推理模型推荐理由:如果你用 GPT-5.6 写代码,可以试试 Sol medium,比 5.5 xhigh 更好用,别被复杂的选项吓到。原文稍后读已读值得跟进有用关注 GPT-5.6
02:45@koltregaskes@koltregaskesGPT-5.6 Sol max 和 xhigh 在 DeepSWE 排行榜上超过了 Fable 5 xhigh 和 max。两者的平均成本更低,输出 token 更少、步骤更少。GPT-5.6 Tera max 得分与 Fable 几乎相同。这些结果表明 GPT-5.6 系列在软件工程任务上具有竞争力。AI模型GPT-5.6DeepSWEFable 56 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 新变体在 DeepSWE 上干过了 Fable 5,还更便宜更快,值得关注。原文稍后读已读值得跟进有用关注 GPT-5.6