08:05宝玉@dotey精选Fable 5.1 通过 fable-advisor 插件指挥 GPT-5.6 Luna 智能体完成工作。该工作流包含三个步骤:Fable 5.1 进行编排,GPT-5.6 Luna 执行任务,最后由 Fable 5.1 进行审查。这种模式类似于上下文蒸馏,以更低成本获得 Fable 5.1 的智能能力。AI产品FableGPT-5.6Claude Code推荐理由:Fable 5.1 能指挥 GPT-5.6 Luna 智能体,比直接使用 Opus 更灵活,适合 Fable API 用户。原文稍后读已读值得跟进有用关注 Fable
07:32IT之家(博客/媒体)73°Meta 于 2026 年 9 月 2 日发布迄今最强大 AI 模型 Muse Spark 1.3。该模型在编码能力上超越 OpenAI 的 GPT-5.6 Sol,与 Anthropic 的 Claude Fable 5.1 表现持平。相比前代 1.2 版本,新模型减少了约 20% 的工具调用次数,完成相同任务所需 token 减少 25%。Muse Spark 1.3 针对长周期智能体任务优化,能在单一长线程中协作处理多工作流。AI模型Muse SparkGPT-5.6Claude Fable10 个信源在谈事件专题推荐理由:Meta 新出的 Muse Spark 1.3 编码能力超 GPT-5.6,工具调用减少 20%,还支持长线程多任务处理。原文稍后读已读值得跟进有用关注 Muse Spark
06:43lmarena.ai@lmarena_ai73°Peter Gostev将Fable 5.1与Anthropic最新模型、Opus 5、GPT-5.6、Kimi K3、GLM 5.3、Qwen-3.8、Grok-4.6和DeepSeek进行了对比测试。测试涵盖编程、3D、SVG、研究和数据可视化五大任务。各模型生成成本从几美元到65美元以上不等。Fable 5.1在质量与价格平衡方面表现突出。AI模型Fable 5.1AnthropicGPT-5.610 个信源在谈事件专题推荐理由:有人实测了Fable 5.1与8个主流模型的表现,看看它是否真的更值得用。原文稍后读已读值得跟进有用关注 Fable 5.1
05:43官方一手AWS Machine Learning Blog@Frank Huang澳大利亚团队现可通过亚太(悉尼)和亚太(墨尔本)区域,使用Amazon Bedrock访问OpenAI GPT-5.6 Sol、Terra和Luna模型。该服务支持全球跨区域推理功能。文章详细介绍了如何调用这些模型、使用提示缓存、设置Codex与OpenID Connect认证,以及通过Amazon CloudWatch监控使用情况。AI产品OpenAIGPT-5.6Amazon Bedrock10 个信源在谈事件专题推荐理由:AWS在澳大利亚上线了OpenAI最新GPT-5.6模型,支持跨区域调用,还附带了完整的使用教程和监控方案。原文稍后读已读值得跟进有用关注 OpenAI
04:24官方一手@OpenAIDevs@OpenAIDevs73°GPT-5.6 Sol正在帮助@bryantchou的团队在@ployai公司协调复杂的营销活动。该团队正在尝试使用子智能体(subagents)来节省时间和降低成本。这一应用展示了GPT-5.6 Sol在营销自动化方面的能力。AI产品GPT-5.6@ployai营销自动化推荐理由:OpenAI的GPT-5.6 Sol正被用于营销活动管理,通过子智能体实现成本节约和时间优化。原文稍后读已读值得跟进有用关注 GPT-5.6
09:42官方一手arXiv: OpenAI@Gokhan Dogru, Adrià Martín MorLoopCAT是一款Apache-2.0许可的本地优先计算机辅助翻译环境,由OpenAI Codex使用GPT-5.5和GPT-5.6共同开发。该工具结合本地项目存储、翻译记忆库、术语库、质量保证和文档交换功能,支持连接本地或托管AI服务。LoopCAT提供英语、加泰罗尼亚语和土耳其语界面,学生可翻译UI字符串、审查自动生成的目标草案并测试界面。技巧LoopCATGPT-5.5GPT-5.69 个信源在谈事件专题推荐理由:OpenAI用GPT-5.5/5.6开发的翻译教学工具,让学生既能操作工作流又能评估AI决策。原文稍后读已读值得跟进有用关注 LoopCAT
04:33elvis@omarsar0DAIR.AI分享了Qwen团队关于长周期智能体的研究论文。E-Commerce Bench基准测试让智能体模拟运营365天的多家网店,评估了18个前沿模型在七个维度上的表现。GPT-5.6 Sol盈利最多,将10万美元本金增长至143万美元,但在欺诈防范方面排名第16。开源模型中,Qwen3.8-Max-Preview表现最佳,收益达416,252美元,比GLM 5.2高出38%。论文QwenGPT-5.6E-Commerce Bench推荐理由:Qwen团队测试了18个模型在365天电商运营中的表现,GPT-5.6 Sol盈利最多但效率不高,Qwen3.8-Max-Preview在开源模型中领先。原文稍后读已读值得跟进有用关注 Qwen
03:33Aravind Srinivas@AravSrinivasFable是目前性能领先的模型,在Perplexity Computer上作为高任务调度器使用。Computer仍使用GPT 5.6(Terra)模型作为成本效益高的子代理。Fable提供前沿规划能力,与GPT 5.6形成互补。AI产品FableGPT-5.6Perplexity推荐理由:Perplexity Computer整合Fable和GPT 5.6,前者负责高难度任务规划,后者处理成本敏感任务。原文稍后读已读值得跟进有用关注 Fable
00:34elvis@omarsar0精选73°Shopify ML团队训练的0.8B模型在特定任务上击败了GPT-5.6-sol xhigh。小型专用模型在特殊场景下表现出色。拥有自己的智能堆栈对未来公司保持竞争力至关重要。Tobi Lutke强调了小型模型在特定用例中的有效性。AI模型ShopifyGPT-5.60.8B模型推荐理由:Shopify用0.8B模型干翻GPT-5.6,小模型专用场景真香原文稍后读已读值得跟进有用关注 Shopify
23:43Viking@vikingmuteGPT-5.6 Sol Ultra 在大项目重构和新项目多模块同时实现中表现突出。该模型消耗时间和token量较大,存在过度思考问题。用户反馈 Sol High 版本已能满足出计划需求。建议搭配 Luna Max 或其他干活agent使用效果更佳。AI模型GPT-5.6Sol UltraSol High推荐理由:GPT-5.6 Sol Ultra 耗时耗token,过度思考,Sol High 加干活agent组合更实用原文稍后读已读值得跟进有用关注 GPT-5.6
08:26官方账号Simon Willison’s Weblog(博客/媒体)精选73°OpenAI 于7月9日发布 ChatGPT Work,仅面向20美元/月及以上订阅用户。该产品分为云端版和本地版两种形式,云端版可通过 chatgpt.com 或移动应用访问。Work 提供多种模型选择,包括 GPT-5.6 Sol、Luna、Terra,以及不同推理级别,还具备代码执行环境、无头浏览器和持久文件系统等独特功能。AI产品ChatGPT WorkOpenAIGPT-5.610 个信源在谈事件专题推荐理由:OpenAI 推出了 ChatGPT Work,支持 GPT-5.6 多模型和代码执行,与普通 Chat 有明显区别。原文稍后读已读值得跟进有用关注 ChatGPT Work
04:48宝玉@dotey开发者dotey建议在UI开发中优先使用Claude系列模型,特别是Fable。GPT-5.6在UI生成方面表现不佳。SwiftUI在AI辅助开发中效果有限,而AppKit或UIKit能提供更好的开发体验。有开发者报告使用AI生成UI功能时消耗了超过1亿token仍未解决问题。技巧ClaudeFableGPT-5.6推荐理由:dotey实测发现Claude系列写UI效果最好,GPT-5.6不太行,SwiftUI也有局限。原文稍后读已读值得跟进有用关注 Claude
09:36官方账号Perplexity@perplexity_ai精选Perplexity Search API在Artificial Analysis Search Index上占据前三名。中等设置得分80,比之前的领先者Parallel(advanced)和Brave Search(LLM context)高出5分。三种上下文变体(低、中、高)的得分分别为77、80和79。其每任务模型推理成本最低,为0.028-0.034美元,总成本约0.091美元。AI产品PerplexitySearch APIArtificial Analysis推荐理由:Perplexity新搜索API在权威评测中夺冠,三种配置都进前三,成本还最低。原文稍后读已读值得跟进有用关注 Perplexity
07:06Aravind Srinivas@AravSrinivas精选Perplexity Search在Artificial Analysis Search Index基准测试中表现最佳,三种上下文设置均位居排行榜前列。其中中等上下文设置得分80,高于Parallel(advanced)和Brave Search(LLM context)的75分。Perplexity的搜索结果负载更小,模型推理成本最低,每任务成本在0.028至0.034美元之间。AI产品Perplexity搜索APIArtificial Analysis推荐理由:Perplexity搜索在基准测试中击败竞争对手,成本更低,三种上下文设置表现均佳。原文稍后读已读值得跟进有用关注 Perplexity
02:16官方账号Greg Brockman@gdbOpenRouter平台对GPT-5.6 Terra和Luna模型进行大幅折扣后,令牌使用量激增13.8倍。这一现象体现了杰文斯悖论:技术提高资源使用效率反而导致总消耗增加。OpenRouter平台上的价格调整直接影响了用户行为模式。模型降价策略显著改变了资源消耗趋势。行业GPT-5.6OpenRouter杰文斯悖论推荐理由:OpenRouter对GPT-5.6模型打折,使用量暴增13.8倍,验证了杰文斯悖论在AI领域的有趣应用。原文稍后读已读值得跟进有用关注 GPT-5.6
21:36官方一手AWS Machine Learning Blog@Sahil Verma精选Amazon Bedrock现已支持OpenAI GPT-5.6模型Terra和Luna在印度的地理跨区域推理功能。用户如果有本地数据处理需求,现在可以大规模使用这些模型。Amazon Bedrock会将推理请求和数据保留在印度境内。AI产品GPT-5.6Amazon BedrockOpenAI10 个信源在谈事件专题推荐理由:AWS在Bedrock上新增GPT-5.6模型的印度区域推理,数据不出国。原文稍后读已读值得跟进有用关注 GPT-5.6
04:51官方一手@OpenAIDevs@OpenAIDevs78°与 AWS 合作优化 Kiro 和 GPT-5.6,GPT-5.6 Terra 在 Kiro 开发环境中实现每任务约 82% 成本降低。Terminal-Bench 2.1 测试。AI模型GPT-5.6KiroOpenAI10 个信源在谈事件专题推荐理由:OpenAI 与 AWS 合作优化 Kiro 和 GPT-5.6,性价比大幅提升,值得一看。原文稍后读已读值得跟进有用关注 GPT-5.6
04:48官方一手@OpenAIDevs@OpenAIDevs78°GPT-5.6模型加入kirodotdev,支持开发者在生产环境中规划、构建、测试和审查软件。AI模型GPT-5.6kirodotdev智能体推荐理由:想用GPT-5.6模型规划软件的开发流程,kirodotdev是个好选择。原文稍后读已读值得跟进有用关注 GPT-5.6
03:09官方一手OpenAI Blog(博客/媒体)GPT-5.6在Kiro版推出,助力开发者以更优价格性能规划、构建、审查和测试软件。AI模型GPT-5.6Kiro智能体推荐理由:OpenAI推出GPT-5.6 Kiro版,价格性能更优,开发效率提升。原文稍后读已读值得跟进有用关注 GPT-5.6
08:28官方账号Simon Willison’s Weblog(博客/媒体)精选Promptwatch 的数据显示,ChatGPT 搜索中使用 site: 运算符的查询比例在 GPT-5.6 推出后显著增加。该比例从 0.3%-0.5% 跃升至 16-17%。OpenAI 曾宣布 GPT-5.6 Sol 在 Chat 中将提供更可靠的事实和更聚焦的答案。Promptwatch 还发现 ChatGPT 搜索中 Reddit 的使用概率大幅降低。AI产品ChatGPTGPT-5.6site:operator10 个信源在谈事件专题推荐理由:Promptwatch 发现 ChatGPT 搜索里 site: 运算符的使用比例从 0.5% 暴增到 17%,这和 GPT-5.6 的更新有关,还发现它现在不怎么用 Reddit 了。原文稍后读已读值得跟进有用关注 ChatGPT
07:50GitHub@github88°OpenAI 将 GPT-5.6 Sol 的价格下调了 50%,优惠期至 9月3日。GPT-5.6 系列包含 Sol、Terra 和 Luna 三个版本。Sol 版本拥有最高的推理上限,适合复杂推理和大型代码库。Terra 是平衡的默认选项,适合日常交互式和智能体编程。Luna 是轻量级、成本效益高的版本,适用于小型快速任务。AI产品GPT-5.6OpenAIGitHub Copilot10 个信源在谈事件专题推荐理由:OpenAI 把 GPT-5.6 Sol 降价一半,到9月3号。这个版本推理能力最强,现在用 GitHub Copilot 就能试。原文稍后读已读值得跟进有用关注 GPT-5.6
06:02官方一手AWS Machine Learning Blog@Melanie LiAmazon Bedrock 现在在超过 25 个 AWS 区域提供 OpenAI GPT-5.6 模型(Sol、Terra 和 Luna)的跨区域推理功能。该功能通过 US 地理和全球推理配置文件来路由请求,以实现更高的吞吐量。用户可以通过 OpenAI 和 Converse API 调用这些模型。文档还介绍了如何配置 IAM、配额和监控。AI产品OpenAIGPT-5.6Amazon Bedrock10 个信源在谈事件专题推荐理由:AWS 在 Bedrock 上为 OpenAI GPT-5.6 模型增加了跨区域推理,能提升全球请求的吞吐量,适合需要低延迟和高可用性的开发者。原文稍后读已读值得跟进有用关注 OpenAI
23:55Amjad Masad@amasad72°Replit与OpenAI合作推出免费模式,使用GPT-5.6 Luna模型。该模式旨在解决智能体降低软件成本却提高编程成本的问题。Replit Free Mode通过OpenAI技术让智能体更易于获取。AI产品ReplitOpenAIGPT-5.610 个信源在谈事件专题推荐理由:Replit和OpenAI联手推出免费编程模式,GPT-5.6 Luna让智能体更亲民。原文稍后读已读值得跟进有用关注 Replit
11:37IT之家(博客/媒体)精选OpenAI Codex团队负责人Thibault Sottiaux回应GPT-5.6系列模型在Codex中执行误删用户文件问题。该问题源于清理临时文件的命令错误指向用户主目录,特别是当Codex重用$HOME等系统环境变量时。OpenAI已添加多层保护措施,包括执行前检查删除目标、创建新临时目录、增强高风险命令识别等。AI产品OpenAICodexGPT-5.610 个信源在谈事件专题推荐理由:OpenAI修复了Codex调用GPT-5.6误删文件的bug,加了多层保护,以后用更安全了。原文稍后读已读值得跟进有用关注 OpenAI
10:23官方一手arXiv: DeepSeek@Ziheng Qin, Yaxin Lu, Zhangyang Atlas Wang, Kai Wang精选StateM 是一个不修改模型权重的 agent 运行时,通过状态管理和可恢复流程提升执行系统。在 Terminal-Bench 2.1 上,StateM 将 GPT-5.5 xhigh 从 83.1% 提到 92.1%,GPT-5.6 Sol xhigh 达到 95.3% 原始准确率,覆盖 445 次试验和全部 89 个任务。同一套 runbook 让 GPT-5.6 Luna 从 76.7% 升至 85.4%,超过 Sol xhigh 参考值 84.9%。用不到 38 美元的适配,DeepSeek-V4 Flash 从 82.7% 提高到 88.1%,在 88 任务核心集上到 89.1%,最终 API 花费约 15 美元,对比 GPT 参考的 574.68 美元。代码已开源在 github.com/henryqin1997/statem。论文StateMGPT-5.6DeepSeek-V4推荐理由:StateM 不改模型权重,光靠升级执行系统就把 GPT-5.6 在终端测试的准确率拉到 95.3%,成本只要 15 美元,值得看看它的思路。原文稍后读已读值得跟进有用关注 StateM
08:26官方账号Simon Willison’s Weblog(博客/媒体)精选72°Qwen 3.8 27B在Artificial Analysis Intelligence Index上获得52分,与GPT-5.6 Luna(max)持平,仅比GLM-5.2(max)和DeepSeek V4 Pro 0813(max)低1分。其中GLM-5.2拥有753B参数,DeepSeek V4 Pro为1.6B参数,而Qwen 3.8 27B仅27B参数。该模型以较小规模达到顶尖水平,表现惊人。AI模型QwenGPT-5.6GLM-5.2推荐理由:27B的小模型追平了GPT-5.6和GLM-5.2,参数还小几十倍,值得看看。原文稍后读已读值得跟进有用关注 Qwen
02:43OpenRouter@OpenRouterAIOpenAI的GPT-5.6 Sol已在OpenRouter上降价50%,覆盖batch API、flex和priority快速通道。flex档位输入价格降至$1.25,输出价格降至$7.50。折扣自动生效,直接调用openai/gpt-5.6-sol即可享受。AI产品OpenRouterGPT-5.6OpenAI10 个信源在谈事件专题推荐理由:想试GPT-5.6 Sol的话现在划算,OpenRouter直接半价,flex输入才1.25美元。原文稍后读已读值得跟进有用关注 OpenRouter
00:21官方一手@OpenAIDevs@OpenAIDevs精选OpenAI开发者团队总结了初创公司用GPT-5.6构建智能体的实践经验。核心是通过更精准的模型选择、推理策略和工具调用降低Agent成本。团队发现,让模型在复杂任务中自主决定何时调用工具,能减少无效计算。这些经验来自多个行业的实际部署,而非实验室基准。技巧GPT-5.6OpenAI智能体8 个信源在谈事件专题推荐理由:OpenAI官方分享了用GPT-5.6做智能体的省钱打法,从选模型到调工具都有,做Agent的可以学几招。原文稍后读已读值得跟进有用关注 GPT-5.6
00:20官方一手@OpenAIDevs@OpenAIDevs73°OpenAI 发布 GPT-5.6 Sol 的基准结果。在 ARC-AGI-3 任务上,得分从 13.3% 提升到 38.3%。同时输出 token 数量减少约 6 倍。OpenAI 称这一改进来自保留推理和压缩机制。该结果由 OpenAI Devs 在 X 平台公布。AI模型GPT-5.6ARC-AGI-3OpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 在 ARC-AGI-3 上分数翻倍还多,token 还省了六倍,看看他们怎么做到的。原文稍后读已读值得跟进有用关注 GPT-5.6
17:15AI产品黄叔@PMbackttfuture开发者用Cursor的Fable 5规划Grok 4.6开发,完成TokenStep软件升级。新版TokenStep的浮窗改为横版,新增Cursor和Grok的用量统计。该开发者认为Grok 4.6在开发上较大幅度逊于GPT 5.6,许多细节需要反复调整。但SuperGrok Heavy和Cursor的用量惊人。技巧Grok 4.6GPT-5.6Cursor3 个信源在谈事件专题推荐理由:开发者升级了TokenStep,能统计Cursor和Grok的token用量。他实测下来写代码还是GPT-5.6更顺,Grok 4.6虽然免费但细节要反复调。原文稍后读已读值得跟进有用关注 Grok 4.6
14:42IT之家(博客/媒体)77°OpenAI近期近乎六次重组,首席营收官丹尼斯·德雷瑟上任不足一年即离职,AI伦理负责人克洛伊·巴卡拉任职不到一年也离开。公司的“准备”团队已解散,该团队负责评估模型的严重或灾难性风险。OpenAI年化营收从去年底240亿美元增至本月约400亿美元,但对手Anthropic从90亿美元飙升至5月的470亿美元,增幅逾四倍。知情人士称,OpenAI大部分增长来自五周前发布的GPT-5.6,而公司估值已达8520亿美元,员工通过约70亿美元要约收购套现。行业OpenAIAnthropicGPT-5.610 个信源在谈事件专题推荐理由:OpenAI最近高管走马灯,准备团队解散,年内重组近六次,还面临Anthropic营收反超,想看懂IPO前夜这出内斗戏可以读读。原文稍后读已读值得跟进有用关注 OpenAI
20:14小互@imxiaohuOpenAI 发布 GPT-5.6 Sol。官方测试显示,该模型在“低”推理强度下的表现超过 GPT-5.5 在“高”推理强度下的水准。它能更敏锐地识别无效信息,减少不必要的循环推理,从而节省 Token 消耗,更快得到正确答案。AI模型GPT-5.6OpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 Sol 在低推理强度下就超过了 GPT-5.5 的高推理强度表现,还更省 Token,你可以直接上手试试。原文稍后读已读值得跟进有用关注 GPT-5.6
19:47小互@imxiaohu72°OpenAI发布GPT-5.6构建者指南,教开发者将Agent账单从33美元降至1.33美元。指南涉及模型选择、推理档位和三个新API开关的具体配置。6家创业公司提供了线上实测数据。核心思路是改用中小型号并优化架构,无需无脑上旗舰模型也能达到同等效果。技巧GPT-5.6OpenAI智能体10 个信源在谈事件专题推荐理由:想省Agent成本?OpenAI官方指南给了具体配置和实测数字,照着改就能把账单砍到零头。原文稍后读已读值得跟进有用关注 GPT-5.6
14:16官方账号Sam Altman@sama79°OpenAI预览Ultrafast模式,将GPT-5.6 Sol运行速度提升至标准版本的14倍。该模式率先通过OpenAI API向一批精选客户开放。随着算力容量增长,OpenAI会逐步扩大对企业用户的访问范围。目前尚未公布全面上线的具体时间。AI模型GPT-5.6OpenAIUltrafast模式10 个信源在谈事件专题推荐理由:OpenAI给GPT-5.6 Sol开了14倍速模式,先在API小范围试水,做开发的朋友可以紧盯后续扩容。原文稍后读已读值得跟进有用关注 GPT-5.6
13:11shao__meng@shao__meng精选76°DeepSeek Harness开源发布,开发者可自行安装体验。一位用户使用DeepSeek V4 Flash模型,消耗1390万Token、耗时30多分钟生成一个网站。生成结果不理想,该用户认为远不如Codex搭配GPT-5.6的组合。帖子当前获得729次浏览和4条回复。AI产品DeepSeek HarnessDeepSeek V4 FlashCodex10 个信源在谈事件专题推荐理由:DeepSeek Harness开源了,但有人试完说生成的网站不如Codex+GPT-5.6,你装之前先看看这个。原文稍后读已读值得跟进有用关注 DeepSeek Harness
03:39Paul Couvert@itsPaulAi83°谷歌发布Gemini 3.7 Flash,被评价为该智能水平上最高效的模型之一。它的性能优于Sonnet 5、GPT-5.6 Terra和Muse Spark 1.2。价格仅为Gemini 3.6 Flash的一半,优惠至少持续到年底。目前已在AI Studio和Antigravity平台上线。只有GPT-5.6 Luna Max在效率上更胜一筹,但它不擅长前端任务。AI模型Gemini 3.7 FlashGoogleSonnet 5推荐理由:谷歌新发的Gemini 3.7 Flash,效率比Sonnet 5高,价格只有3.6 Flash一半,现在AI Studio就能玩。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:28官方一手OpenAI Blog(博客/媒体)OpenAI发布GPT-5.6开发者指南,面向创业公司展示如何构建更快速、成本更低的AI代理。指南强调通过更聪明的模型选择来优化支出,并介绍了Responses API的新能力。文中以GPT-5.6为例,说明初创团队如何在实际开发中应用这些功能。技巧GPT-5.6Responses APIOpenAI10 个信源在谈事件专题推荐理由:OpenAI出了份GPT-5.6实操指南,教你怎么选模型、用新API,把AI代理做得更快更省钱。搞开发的值得一看。原文稍后读已读值得跟进有用关注 GPT-5.6
18:05Cognition@cognition_labsGrok 4.6 现已集成到 Devin 中。相比 Grok 4.5,它在多项基准上表现更好。成绩超过 GPT-5.6 Sol,排名仅次于 Opus 5 和 Fable 5。AI模型GrokDevinGPT-5.6推荐理由:Grok 4.6 上 Devin 了,跑分超过 GPT-5.6 Sol,只差 Opus 5 和 Fable 5,想试试的可以关注。原文稍后读已读值得跟进有用关注 Grok
18:01IT之家(博客/媒体)外媒《连线》援引消息人士称,美国前沿AI模型网络安全审查机制“几乎肯定”会在未来数月扩展至开源(开放权重)模型。该机制目前仅覆盖性能与Anthropic Claude Mythos或OpenAI GPT-5.6相当的闭源模型,且仍属自愿性质。有美国官员认为强制审查可能抑制AI发展。白宫也在考虑,若闭源模型过审,企业可能降低对未审开源模型的兴趣,进而抑制开源模型推出。行业开源模型AI安全Anthropic10 个信源在谈事件专题推荐理由:美国可能要把开源模型也纳入AI安全审查了,现在只查闭源,但风向在变。做开源模型的团队得留意政策风险。原文稍后读已读值得跟进有用关注 开源模型
17:53官方账号Decoder@Matthias BastianxAI 发布 Grok 4.6,在 Artificial Analysis 智能指数上得分 61,与 GPT-5.6 Sol 持平,仅次于 Claude Opus 5。在智能体任务中,Grok 4.6 完成复杂工作流平均约 53 步,而 Claude Opus 5 需要约 103 步。Grok 4.6 的 API 价格比 OpenAI 最强模型低 60% 以上。AI模型Grok 4.6GPT-5.6Claude Opus 510 个信源在谈事件专题推荐理由:xAI 的 Grok 4.6 跑分追平 GPT-5.6,智能体任务比 Claude 更省步数,价格还便宜一大截,想换 API 的可以看看。原文稍后读已读值得跟进有用关注 Grok 4.6