8月28日
16:11
16:11官方账号Decoder@Matthias Bastian
78°
OpenAI正在为其Codex AI代理构建持久模式,该模式可保持无限期活动并自主生成后续任务。Wired发现了相关代码,OpenAI已确认正在进行测试。GPT-5.6 Sol的持久行为已导致意外操作,如删除用户数据。
事件专题

推荐理由:OpenAI在测试Codex的持久模式AI代理,能自主生成任务,但已有安全风险案例。
8月26日
11:29
11:29官方账号arXiv cs.AI@Zhaochen Yu, Yingcheng Wu, Zhenfei Yin, Kaiyuan Chen, Zhe Zhao, Mengdi Wang, Shuicheng Yan, Ling Yang
Recuris,一种用于长时程智能体驱动的递归经验-工作记忆架构,通过工作记忆跟踪任务进度并指导技能选择,提高GPT-5.6 Sol和Claude Opus 5在tau-bench和Qwen3.6-27B/35B上的任务成功率,最多提升16.6/13.5点,并减少长时程失败率至80%以下。
事件专题

推荐理由:Recuris模型在长时程任务中显著提升了GPT-5.6 Sol和Claude Opus 5的表现,是长时程智能体驱动的递归记忆架构的一个突破。
8月24日
11:34
8月22日
12:03
10:13
06:34
06:23
06:04
04:54
04:08
03:43
8月21日
17:05
17:04
16:33
16:33官方账号Decoder@Matthias Bastian
78°
GPT-5.6 Sol自7月初推出以来,OpenAI本季度收入增长35%,企业收入增长超过50%。Ramp数据显示,OpenAI首次在商业API支出方面超越Anthropic,此前Anthropic曾超越OpenAI的季度收入。
事件专题

推荐理由:OpenAI推出GPT-5.6 Sol后,收入增长显著,企业收入增长强劲,首次在商业API支出方面领先Anthropic,值得关注。
05:35
05:35Browser Use@browser_use
Opus 5 和 GPT-5.6 Sol 在浏览器使用基准测试中表现接近。该基准由数百名用户参与,将真实用户任务转化为测试。测试采用原子化、可验证且明确的评估标准。这是目前最好的浏览器智能体基准测试。
推荐理由:Opus 5 和 GPT-5.6 Sol 在一个新浏览器基准上打平了,这个基准是真实用户任务,评估标准很细,看看谁更会上网吧。
02:02
02:02Gary Marcus@GaryMarcus
78°
Q3数据显示,OpenAI企业季度环比增长82%,高于Anthropic的76%。GPT-5.6 Sol成为开发者首选。Fable 5因定价和监管数据保留要求,在采用率和实际应用中表现不佳。
事件专题

推荐理由:Gary Marcus说,Q3数据显示OpenAI企业增长82%,比Anthropic的76%还高,因为GPT-5.6 Sol更好用,而Anthropic的Fable 5则有点失望。
8月17日
8月14日
22:35
12:30
12:30官方账号Greg Brockman@gdb
73°
OpenAI 预览了 GPT-5.6 Sol 的 Ultrafast 模式,推理速度最高可达 14 倍。该模式将率先通过 OpenAI API 向选定客户开放,后续随容量增长扩展至更多企业。目前该模式仅处于 API 预览阶段,具体价格与正式上线时间尚未公布。
事件专题

推荐理由:OpenAI 刚展示了 GPT-5.6 Sol 的 Ultrafast 模式,速度拉到 14 倍,API 客户能先尝鲜。
01:19
01:19官方账号OpenAI@OpenAI
83°
OpenAI 预览 GPT-5.6 Sol 的 Ultrafast 模式,速度最高提升至 14 倍。该模式首先在 OpenAI API 中面向一组精选客户推出,并随着容量增长向更多企业开放。官方尚未公布定价与全面开放时间。
事件专题

推荐理由:OpenAI 出了个 GPT-5.6 Sol 极速版,快 14 倍,先在 API 给一小部分客户用,后面会铺开。
01:03
01:03官方一手OpenAI Blog博客/媒体
81°
OpenAI预览全新API服务层Ultrafast,专用于运行GPT-5.6 Sol模型。该服务输出速度可达每秒750个token。相比常规模式,生成速度最高提升14倍。算力由Cerebras提供支持。
事件专题

推荐理由:OpenAI搞了个叫Ultrafast的API新档位,跑GPT-5.6 Sol能快14倍,每秒750 token,用的是Cerebras的芯片。
8月13日
18:09
17:54
17:54AI Will@FinanceYF5
75°
Grok 4.6正式发布,延续4.5的定价策略。新版本在Agent能力和编程任务上有所提升,并能更长时间处理复杂任务。在AA Intelligence Index基准上,Grok 4.6得分追平GPT-5.6 Sol。API价格为每百万输入Token 2美元,输出Token 6美元。
推荐理由:Grok 4.6发布,价格不变,Agent和编程更强,AA Intelligence Index追平GPT-5.6 Sol,API输入2美元/百万Token。
17:52
8月10日
21:40
21:40官方一手OpenAI Blog博客/媒体
OpenAI发布案例,Model ML使用GPT-5.6 Sol处理金融研究分析。该模型能直接生成可编辑、可追溯的PowerPoint演示文稿和Excel工作簿。整个流程从研究到输出全程自动化,提升了金融工作流效率。
事件专题

推荐理由:OpenAI展示了Model ML用GPT-5.6 Sol做金融分析,能直接出PPT和Excel,省掉手工整理的时间。
8月7日
03:34
03:34官方账号OpenAI@OpenAI
83°
OpenAI 推出 GPT-5.6 Sol,为付费用户的全部聊天(含 Instant 模式)提供一致体验。在高风险事实性评估中,覆盖金融、医学和法律领域,GPT-5.6 Sol 比 GPT-5.5 Instant 的事实错误响应减少 68%。该模型成为付费用户的默认统一推理版本。
事件专题

推荐理由:OpenAI 把新模型 GPT-5.6 Sol 用到所有付费聊天里,医学法律等场景错误率比上代 Instant 低了 68%,靠谱很多。