05:23elvis@omarsar082°OpenAI 宣布降低 GPT-5.6 Luna 的 API 价格 80%,GPT-5.6 Terra 降价 20%,同时为 GPT-5.6 Sol 提供更快的推理选项。Luna 和 Terra 的降价已反映在 Codex 和 ChatGPT Work 的用量计费中,用户可使用更长时间。GPT-5.6-Sol 的推理速度得到提升,但具体倍数未公布。AI产品GPT-5.6OpenAIAPI10 个信源在谈事件专题推荐理由:OpenAI 把 GPT-5.6 Luna 价格砍了八成,Terra 也降了两成,用 API 更划算了,尤其适合批量任务。原文稍后读已读值得跟进有用关注 GPT-5.6
04:42官方账号Greg Brockman@gdb精选OpenAI下调了GPT-5.6 Terra和GPT-5.6 Luna的定价。更新后的FrontierCode 1.1基准显示,GPT-5.6系列在价格/性能效率上处于帕累托最优曲线。新折扣使其成为当前性价比最佳的选择。AI产品GPT-5.6OpenAIFrontierCode10 个信源在谈事件专题推荐理由:OpenAI给GPT-5.6 Terra和Luna降价了,现在在FrontierCode 1.1上性价比特别高,适合编程评测场景。原文稍后读已读值得跟进有用关注 GPT-5.6
03:16OpenRouter@OpenRouterAI77°OpenAI 宣布 GPT-5.6 Luna 降价 80%,GPT-5.6 Terra 降价 20%。GPT-5.6 Sol 在 API 中提供更快的推理选项。降价后,在 Codex 和 ChatGPT Work 中的用量计算方式同步调整,用户使用额度更耐用。AI产品GPT-5.6OpenAIAPI定价10 个信源在谈事件专题推荐理由:OpenAI 给 GPT-5.6 系列降价了,Luna 降八成、Terra 降两成,Sol 还更快。正在用这些模型做产品或开发的,赶紧看下新价格和用量规则。原文稍后读已读值得跟进有用关注 GPT-5.6
02:53官方账号Decoder@Matthias Bastian75°OpenAI自7月30日起将GPT-5.6 Luna价格下调80%,Terra价格下调20%。OpenAI称其顶级Sol模型帮助提升了基础设施效率,从而允许降价。此举可能受到来自中国低价AI供应商以及微软MAI模型的竞争压力影响。AI产品GPT-5.6LunaTerra10 个信源在谈事件专题推荐理由:OpenAI把最便宜的GPT-5.6 Luna砍价八成,直接对标中国厂商的价格战,想省钱可以看看这个。原文稍后读已读值得跟进有用关注 GPT-5.6
02:20官方一手@OpenAIDevs@OpenAIDevs76°OpenAI宣布API中GPT-5.6模型降价,Luna降价80%,Terra降价20%。同时推出GPT-5.6 Sol的更快选项。降价也适用于Codex和ChatGPT Work的用量计算,使开发者以更低成本获得更多智能。此次调整旨在提升成本效率,让每美元产出更多结果。AI产品GPT-5.6OpenAIAPI10 个信源在谈事件专题推荐理由:OpenAI把GPT-5.6 API价格打下来了,Luna降八成,Terra降两成,还给了更快选项Sol,开发成本更低了。原文稍后读已读值得跟进有用关注 GPT-5.6
01:19官方一手OpenAI Blog(博客/媒体)OpenAI发布了GPT-5.6模型,并下调了Luna和Terra计划的定价。新定价旨在提升性价比,使企业能够以更低成本大规模部署AI工作流。OpenAI强调更高效的模型能帮助企业实现规模化应用。AI产品GPT-5.6OpenAILuna10 个信源在谈事件专题推荐理由:OpenAI把GPT-5.6降价了,Luna和Terra现在更划算,适合企业批量部署AI工作流。原文稍后读已读值得跟进有用关注 GPT-5.6
00:09官方一手AWS Machine Learning Blog@Melanie Li75°OpenAI GPT-5.6 的 Sol、Terra 和 Luna 三个模型已在 Amazon Bedrock 上正式可用。新推出的显式提示缓存功能允许用户精确指定缓存哪些部分。缓存复用可降低推理成本。AWS 提供了上手指南和迁移现有 GPT 工作负载的步骤。AI产品Amazon BedrockGPT-5.6OpenAI10 个信源在谈事件专题推荐理由:亚马逊Bedrock现在支持GPT-5.6,还能自己控制缓存哪些提示,省成本又灵活。原文稍后读已读值得跟进有用关注 Amazon Bedrock
13:31小互@imxiaohu81°OpenAI 发现 GPT-5.6 Sol 在 ARC-AGI-3 公开题库中仅得 13.3%,原因是推理过程中的私有思考被丢弃,上下文到达阈值后直接删除早期消息。通过开启 Responses API 将上一次响应 ID 传回以保留推理链,并启用 compaction 将超限上下文压缩为浓缩摘要,得分升至 38.3%。最高档每局输出 token 从 290 万降至 49 万,新程序在“高”档即达到旧程序“最高”档的分数,token 消耗相差约 12 倍。技巧GPT-5.6OpenAIARC-AGI-310 个信源在谈事件专题推荐理由:OpenAI 分享了两个超实用的 API 开关,GPT-5.6 Sol 在 ARC-AGI-3 上分数直接翻了三倍,token 还省了十二倍,搞推理优化的一定要看看。原文稍后读已读值得跟进有用关注 GPT-5.6
10:30官方账号Simon Willison@simonw精选GPT-5.6 通过 Codex 分析生产流量、改进负载均衡、重写 GPU kernel 和运行数百次推测解码实验,将端到端服务成本降低 20%。推测解码使 token 生成效率提升超 15%。这些优化为 OpenAI 每月节省数十亿美元成本。AI模型GPT-5.6Codex推理模型10 个信源在谈事件专题推荐理由:GPT-5.6 自己优化自己,服务成本降了20%,生成效率提了15%,省下来的钱都能买好几个数据中心了。原文稍后读已读值得跟进有用关注 GPT-5.6
04:04官方一手OpenAI Blog(博客/媒体)OpenAI发布GPT-5.6,该模型在模型架构、推理过程和智能体工作流上进行了效率优化,旨在提升每美元实现的智能水平。AI模型GPT-5.6OpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI新模型GPT-5.6,在模型、推理和智能体效率上都有提升,每美元能换更多智能,值得关注。原文稍后读已读值得跟进有用关注 GPT-5.6
01:34官方账号OpenAI@OpenAI79°OpenAI宣布了GPT-5.6模型家族的研究访问计划,参与者可获得前沿模型权限。每个工作间配备商业级隐私保护,研究者数据默认不用于训练模型。计划允许邀请最多4位合作者,并提供培训、实践支持和与其他研究者交流的机会。该计划旨在推动AI研究,目前已有8906次浏览。AI模型OpenAIGPT-5.6研究访问10 个信源在谈事件专题推荐理由:OpenAI开放GPT-5.6研究访问,隐私保护到位,还能带团队一起用,适合科研人员申请。原文稍后读已读值得跟进有用关注 OpenAI
23:59Weaviate@weaviate_io75°Weaviate 的 Query Agent 自动升级,集成了 OpenAI 的 GPT-5.6 Luna 和 Terra 模型。内部测试显示,recall@5 提升5-10%,nDCG@10 提升5-7%。升级无需用户操作,成本与速度不变。Luna 是 GPT-5.6 系列中最快最便宜的模型,Terra 平衡能力与速度。更优模型能更好根据自然语言生成搜索参数。AI产品WeaviateQuery AgentGPT-5.610 个信源在谈事件专题推荐理由:Weaviate 的 Query Agent 现在用上 OpenAI 的新模型 GPT-5.6 Luna 和 Terra,召回率涨了5-10%,不涨价不降速,自动升级真省心。原文稍后读已读值得跟进有用关注 Weaviate
12:05官方账号Greg Brockman@gdbOpenAI 联合创始人 Greg Brockman 公布 GPT-5.6 成功解决了概率论中长期未解决的 Feige 1/e 猜想。该猜想涉及独立非负随机变量 X_i(期望 ≤1)的部分和 S_n,断言 P(S_n ≤ E[S_n] + 1) ≥ 1/e。Brockman 的友人 Zhengqing 使用 GPT-5.6 完成了这一证明,该问题曾是他们午餐时反复讨论的难题。AI模型GPT-5.6Feige 1/e 猜想推理模型10 个信源在谈事件专题推荐理由:GPT-5.6 刚又搞定一个数学难题,这次是概率论里老牌的 Feige 猜想,你可以看看 AI 证明数学定理有多猛。原文稍后读已读值得跟进有用关注 GPT-5.6
16:15Amjad Masad@amasadShouqiao Wang使用OpenAI的GPT-5.6模型,在5天内解决了6个未解决的Erdős问题。该工作不要求深厚的数学知识,而是借助Codex工作流和特定提示词。成果展示了AI模型在算法和数学探索领域的潜力。AI模型GPT-5.6OpenAIErdős问题10 个信源在谈事件专题推荐理由:有人用GPT-5.6在5天解了6个数学界的悬案,而且不用高深数学背景,全靠提示工程。原文稍后读已读值得跟进有用关注 GPT-5.6
06:11lmarena.ai@lmarena_ai精选GPT-5.6 的 Sol、Terra、Luna 三个变体在 Agent Arena 中以 xHigh 设置进行测试。Sol 以 +10.1% 的净改进位列排行榜第二。Terra (+4.0%) 和 Luna (+3.3%) 也取得正向提升,与 Claude Opus 4.8 (+3.5%) 的水平相当。AI模型GPT-5.6Agent ArenaSol推荐理由:GPT-5.6 的 Sol 版在 Agent Arena 上表现亮眼,比 Terra 和 Luna 都强,直接对标 Claude Opus 4.8。想了解新模型实力的话可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
06:06lmarena.ai@lmarena_ai精选GPT-5.6 Terra和Luna(xHigh变体)加入Agent Arena,基于全球社区的真实智能体会话排名第15和第17。在推理努力从低到高时所有变体均有提升,但低推理时Terra持平,Luna下降5.1%。效率前沿显示Luna xHigh(+3.3%)略优于Terra Medium(+3.1%)和Low(+1.2%),更便宜的模型通过更多推理努力可超越昂贵模型。同时GPT-5.6 Sol排名第2,基于7.8K会话,对比GPT-5.5 xHigh净提升1.6%,差距缩小,与Claude Fable 5的“表扬vs抱怨”信号得分分别为+10.9%和+17.3%。AI模型GPT-5.6OpenAIAgent Arena10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6新变体在真实任务基准中表现具体,小模型靠更多推理能超越大模型,值得关注沙箱数据。原文稍后读已读值得跟进有用关注 GPT-5.6
15:41IT之家(博客/媒体)微软 CEO 纳德拉表示,自研 MAI 系列模型在常见 Excel 任务中性能与 GPT-5.6 相当。MAI 模型在面向产品定制的强化学习环境下,通过学习真实工作流程在 GitHub Copilot 和 Excel 上取得显著进步。由于 MAI 不需要依赖最新 AI 加速器,企业可在英伟达 H100/A100 GPU 上运行,部署成本更低。纳德拉强调微软正推进“前沿扩散与控制”策略,未来企业将根据任务编排多种模型。AI模型MAIGPT-5.6微软推荐理由:微软新出的 MAI 模型,在 Excel 上比肩 GPT-5.6,而且跑在旧款显卡上就能用,成本低不少。原文稍后读已读值得跟进有用关注 MAI
00:35官方账号Sam Altman@samaEthan Mollick 指出 GPT-5.6 Pro(仅聊天机器人可用)是目前最智能的模型。GPT-5.6 Ultra(Codex 中的最佳模型)在困难任务上表现较弱。对于真正难题,排名为:GPT-5.6 Sol Pro > Fable 5 Ultracode > GPT-5.6 Sol Ultra。模型命名令用户困惑。AI模型GPT-5.6CodexFable 510 个信源在谈事件专题推荐理由:OpenAI 的模型命名越来越绕了,看看 E 教授的实测对比,帮你搞清 GPT-5.6 各版本谁最强。原文稍后读已读值得跟进有用关注 GPT-5.6
00:02官方一手AWS Machine Learning Blog@Zohreh Norouzi80°OpenAI GPT-5.6的三个变体(Sol、Terra、Luna)已在Amazon Bedrock上正式可用。通过bedrock-mantle端点上的Responses API运行推理,支持提示缓存以降低成本。可连接OpenAI Codex编码智能体,并需规划配额与扩展。技巧GPT-5.6SolTerra10 个信源在谈事件专题推荐理由:AWS把OpenAI GPT-5.6三个型号(Sol、Terra、Luna)搬到了Bedrock,能用提示缓存省钱,还能接Codex写代码,适合想用官方托管的人。原文稍后读已读值得跟进有用关注 GPT-5.6
03:42官方账号Decoder@Matthias Bastian76°OpenAI向美国用户推出“Health in ChatGPT”功能,可连接Apple Health、医疗记录和健康应用。每周已有超过3亿人向ChatGPT咨询健康问题,但付费用户使用更强大的GPT-5.6 Sol模型,免费用户只能使用较弱的GPT-5.5 Instant模型,导致回答质量差异显著。AI产品ChatGPTOpenAI健康咨询10 个信源在谈事件专题推荐理由:OpenAI在健康咨询上新功能,但免费版用弱模型GPT-5.5 Instant,付费版才用GPT-5.6 Sol,效果差不少。原文稍后读已读值得跟进有用关注 ChatGPT
01:37官方账号OpenAI@OpenAI75°OpenAI称每周有超过3亿用户向ChatGPT提出健康相关问题。他们与数百名医生合作,从准确性、安全性、沟通、上下文感知、完整性和适当升级六个维度改进模型。GPT-5.5 Instant已将前沿健康智能开放给所有免费用户。GPT-5.6 Sol进一步提升了处理更复杂健康问题的能力。AI模型ChatGPTOpenAIGPT-5.510 个信源在谈事件专题推荐理由:OpenAI公布新数据,每周3亿人用ChatGPT问健康,还出了GPT-5.6 Sol专门优化复杂问答,免费用户也能体验升级。原文稍后读已读值得跟进有用关注 ChatGPT
11:20官方账号Simon Willison@simonw精选Simon Willison认为循环(loops)是针对无法可靠完成长任务的模型的短期补丁。他指出现有模型如Fable、GPT-5.6以及可能的Kimi K3已经能直接处理长问题直到目标达成,无需循环辅助。这暗示未来模型将原生支持长程推理,循环机制可能逐渐被淘汰。AI模型FableGPT-5.6Kimi K310 个信源在谈事件专题推荐理由:Simon说循环就像拐杖,新模型Fable和GPT-5.6已经能自己走完长任务,不用循环了。原文稍后读已读值得跟进有用关注 Fable
07:21官方账号Simon Willison’s Weblog(博客/媒体)Dylan Castillo针对AI实验室是否专门训练模型生成“骑自行车的鹈鹕”进行了系统测试。他设计了8种动物×6种车辆共48个提示,每个提示在7个模型(GPT-5.6 Terra、Claude Sonnet 5、Gemini 3.5 Flash、Grok 4.5、Qwen3.7-Max、GLM-5.2、DeepSeek V4 Pro)上运行3次,并用GPT-5.6 Luna和Gemini 3.1 Flash-Lite辅助评估。结果显示,没有任何模型在鹈鹕骑自行车场景上表现更好,GLM-5.2虽有微小正向偏差但统计不显著。结论是AI实验室并未系统性地优化这一特定组合。论文GPT-5.6ClaudeGLM-5.22 个信源在谈事件专题推荐理由:别猜了,Dylan用48个提示跑了7个模型,结论是AI实验室没作弊,鹈鹕骑自行车并不比其他组合强。原文稍后读已读值得跟进有用关注 GPT-5.6
22:14Lovable@lovable_devLovable 宣布其 AI 功能新增支持 Gemini 3.6 Flash 和三个 GPT-5.6 模型。用户可通过 Connectors → AI 查看并切换可用模型。新模型旨在提升生成的代码质量和响应速度。Lovable 是一个 AI 驱动的应用开发平台,允许开发者通过自然语言构建应用。AI产品LovableGemini 3.6 FlashGPT-5.610 个信源在谈事件专题推荐理由:Lovable 刚上线了 Gemini 3.6 Flash 和三个 GPT-5.6 模型,做应用开发时能直接选更快的模型了,快去 Connectors 试试。原文稍后读已读值得跟进有用关注 Lovable
15:32@koltregaskes@koltregaskes一位用户在X平台表示,经过一段时间使用后,认为GPT-5.6是自GPT-4相比GPT-3.5以来最明显的性能跳跃。该模型更善于按照指令完成任务,执行力显著增强。用户同时指出主要问题在于Codex(编程界面)仍需大量改进。AI模型GPT-5.6GPT-4Codex10 个信源在谈事件专题推荐理由:有用户说GPT-5.6干活更利索比之前版本强一大截,但Codex还不够好,来看看他的体验。原文稍后读已读值得跟进有用关注 GPT-5.6
01:41官方账号Epoch AI@EpochAIResearch精选Moonshot 的 Kimi K3 在 Epoch Capabilities Index 上获得 156 分,创下开放权重模型的新纪录。该分数使其介于 Opus 4.6(2026年2月发布)和 GPT 5.4(2026年3月发布)之间。Kimi K3 还略高于 GPT 5.6 Luna 的分数,显示开放权重模型正逼近顶尖闭源模型。AI模型Kimi K3MoonshotEpoch Capabilities Index10 个信源在谈事件专题推荐理由:Kimi K3 用开放权重模型跑赢了 GPT 5.6 Luna,在 ECI 基准上刷了新纪录,开源社区值得关注。原文稍后读已读值得跟进有用关注 Kimi K3
02:40宝玉@doteyClaude Code将每周限额临时提升50%,原定活动已延期一个月至8月19日。该提升适用于Pro、Max、Team及基于座位的Enterprise用户。有用户反馈,使用Opus 4.8模型时比GPT 5.6更耐用。ClaudeDevs官方确认延期,并暗示可能成为长期政策。AI产品Claude CodeOpusGPT-5.610 个信源在谈事件专题推荐理由:Claude Code额度还多50%,用Opus 4.8比GPT 5.6更划算,趁延期赶紧薅羊毛。原文稍后读已读值得跟进有用关注 Claude Code
06:54官方账号OpenAI@OpenAI91°GPT-5.6 Sol在“The Last Ones”网络靶场中达到网络安全领域新SOTA。该能力已转化为实际防御效果,帮助团队在真实代码中查找、验证和修复漏洞。OpenAI将其集成到Codex Security中供用户使用。AI模型GPT-5.6SolOpenAI10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6 Sol在网络安全靶场拿了第一,还能直接帮团队修真实漏洞,试试Codex Security吧。原文稍后读已读值得跟进有用关注 GPT-5.6
05:46官方一手@OpenAIDevs@OpenAIDevsOpenAI发布GPT-5.6模型,社区开发者分享了超过10,000个使用该模型的理由。通过GPT-5.6,用户可以将产品从概念快速转化为成品。案例展示了GPT-5.6在代码生成和原型设计中的实际应用。AI模型GPT-5.6OpenAI编程助手10 个信源在谈事件专题推荐理由:OpenAI社区分享了用GPT-5.6开发产品的真实案例,能帮你快速把想法变成成品,效率很高。原文稍后读已读值得跟进有用关注 GPT-5.6
03:39官方账号Decoder@Matthias BastianGPT-5.6 的“完全访问模式”存在漏洞,模型会错误地覆盖临时目录变量,导致自动执行删除操作。多个用户报告其整个主目录被清空。OpenAI 表示该行为不应发生,并承诺增加额外安全措施并发布详细的事后分析报告。行业GPT-5.6OpenAI文件删除10 个信源在谈事件专题推荐理由:GPT-5.6 出了个大bug,在完全访问模式下会自动删除用户文件,OpenAI 正在补救,别急着开全权限。原文稍后读已读值得跟进有用关注 GPT-5.6
01:30宝玉@dotey73°OpenAI证实GPT-5.6在执行编程任务时,可能因用户开启Codex完全访问模式并关闭沙盒保护和自动审查,从而误删整个$HOME目录。模型试图重写$HOME环境变量指定临时目录时出错。OpenAI正在更新开发者提示、引导更安全权限模式,并在Codex Harness添加安全检查。Tibo承诺几天内发布详细事后分析报告。行业GPT-5.6OpenAICodex10 个信源在谈事件专题推荐理由:OpenAI回应了GPT-5.6删文件事件,告诉你原因:关掉沙盒和自动审查就会出这种问题。如果你在用Codex,最好开启沙盒和自动审查。原文稍后读已读值得跟进有用关注 GPT-5.6
05:14The Rundown AI@therundownai一场90分钟的免费直播大师课将展示如何使用ChatGPT Work、GPT-5.6和Codex将源文件和研究资料转化为精美的可编辑演示文稿。由大学教育者Nate Grahek主讲,参与者可以学习到具体的操作流程。课程涵盖从导入文件到生成幻灯片的全链路技巧。RSVP链接已在X平台发布。技巧ChatGPTGPT-5.6Codex推荐理由:想用ChatGPT做PPT?这场90分钟免费直播教你用GPT-5.6和Codex把论文变演示文稿,省时又专业。原文稍后读已读值得跟进有用关注 ChatGPT
01:57官方账号Simon Willison’s Weblog(博客/媒体)精选Thibault Sottiaux披露,GPT-5.6在开启Full access mode且未启用沙箱保护(包括自动审查)时,可能错误删除文件。模型试图覆盖$HOME环境变量以指定临时目录,但误将$HOME目录本身删除。这个Bug已在少数报告中确认,需要用户注意使用权限。AI产品CodexGPT-5.6编程助手推荐理由:小心!GPT-5.6在Codex全权限模式下会误删$HOME目录,记得开自动审查。原文稍后读已读值得跟进有用关注 Codex
12:09Viking@vikingmutereactbench.com 是专门针对 React 编码的真实基准测试,包含 51 个真实任务,均来自开源项目实际 PR 和 Issue。测试结果显示 GPT-5.6 Sol xHigh 综合表现最强,成本仅 1.43 美元。GPT-5.6 Terra Medium 性价比最佳,成本 0.53 美元,而 Claude Fable 5 成本高达 9.05 美元,约为 Sol 的 6-7 倍。AI模型reactbenchGPT-5.6Claude Fable 510 个信源在谈事件专题推荐理由:百万.js 作者搞了个 React 编码实测,51个真实任务,GPT 5.6 最便宜最强,Claude 太贵了。原文稍后读已读值得跟进有用关注 reactbench
10:54IT之家(博客/媒体)在 Tracking AI 最新离线 IQ 测试中,GPT-5.6 全系列模型(SOL、TERRA、视觉版等)均获得 136 分,首次将大模型智商推过 130 的天才门槛,全球仅约 1% 人类达到此分数。此前 o3 等旗舰模型均卡在 130 分以下,Claude-5 Fable 以 130 分紧随其后。开发者测试显示 GPT-5.6 Sol 能通过单条 prompt 生成物理模拟、RAG 客服系统等应用,成本仅为 Fable 5 的零头。但 IQ 测试仅衡量抽象模式识别和逻辑推理,无法评估事实可靠性、工具调用等真实场景能力。AI模型GPT-5.6Claude-5 FableOpenAI10 个信源在谈事件专题推荐理由:GPT-5.6 智商飙到 136 分,比 Claude-5 还高出一截,而且干活也不含糊,一句话就能造出应用,值得看看它到底多强。原文稍后读已读值得跟进有用关注 GPT-5.6
07:03Fireworks AI@FireworksAI_HQDoximity Ask由Doximity开发,基于Fireworks平台训练。在Stanford Arise Lab的独立评估中,它超越GPT-5.6 Sol、Claude Fable 5、OpenEvidence等24个模型。该研究涉及12,747个专家评级,针对真实临床问题。结果表明专用临床模型在安全性上更优。AI模型Doximity AskFireworks临床AI10 个信源在谈事件专题推荐理由:Doximity Ask在独立测试中把GPT-5.6和Claude Fable 5都干翻了,说明医学领域专用模型才是王道。原文稍后读已读值得跟进有用关注 Doximity Ask
02:56elvis@omarsar073°OpenAI 发布了内部自动化红队工具 GPT-Red,用于大规模发现模型中的提示注入漏洞。GPT-Red 对 GPT-5.6 进行了对抗性训练,显著增强了其对抗提示注入的鲁棒性。该方法以高投资回报率提升了 AI 模型的安全性,帮助在更广泛部署前构建更强防御。AI模型GPT-RedGPT-5.6OpenAI10 个信源在谈事件专题推荐理由:OpenAI 用 GPT-Red 对抗训练 GPT-5.6,让模型更抗提示注入,安全提升很实在。原文稍后读已读值得跟进有用关注 GPT-Red
02:25官方账号OpenAI@OpenAI (@OpenAI)精选OpenAI 通过对抗训练(对抗 GPT-Red)提升了 GPT-5.6 的安全性。测试中重放了 GPT-Red 的最强攻击(均未在训练中出现),GPT-5.6 Sol 成为最鲁棒的模型。与四个月前的最佳生产模型相比,失败次数减少至 6 倍。该结果表明对抗训练可显著增强 LLM 对 prompt 注入的防御能力。AI模型GPT-5.6GPT-RedOpenAI10 个信源在谈事件专题推荐理由:OpenAI 刚晒出 GPT-5.6 Sol,抗 prompt 注入比四个月前强了 6 倍,安全能力大幅提升。原文稍后读已读值得跟进有用关注 GPT-5.6
20:36向阳乔木@vista8知名AI博主Ben分享了GPT 5.6模型的四种模式搭配建议:主要开发和创意工作推荐Sol medium,复杂任务开启Ultra并利用大量Subagent处理后台代理,日常对话用Luna xhigh。Sol在UI方面表现好,Max等级下写作能力强。Terra是GPT 5.5的升级版,UI和写作有小幅提升,更易被提示词引导。Luna有小模型味,模糊提示词下理解欠佳,需清晰定义任务。技巧GPT-5.6SolUltra推荐理由:Ben实测了GPT 5.6的Sol、Ultra、Terra、Luna四个模式,告诉你每个模式适合什么活,省得自己瞎试。原文稍后读已读值得跟进有用关注 GPT-5.6
16:42官方账号Decoder@Jonathan Kemper自6月初起,OpenAI的编程工具Codex对主智能体传递给子智能体的指令进行加密。开发者无法再追踪任务如何在内部委派。对于更大的GPT-5.6变体Sol和Terra,加密是强制性的。AI产品CodexOpenAIGPT-5.610 个信源在谈事件专题推荐理由:OpenAI给Codex加了道加密锁,智能体之间怎么聊的你再也看不到了,连GPT-5.6的Sol和Terra都是强制加密的。原文稍后读已读值得跟进有用关注 Codex