7月10日
11:03
01:44
01:44官方一手OpenAI Blog博客/媒体
OpenAI宣布启动针对GPT-5.5的生物漏洞赏金计划,邀请安全研究人员评估模型在生物安全领域的潜在风险。该计划旨在通过奖励机制发现模型可能被用于恶意生物设计的问题。具体奖励金额和提交方式已在OpenAI官网公布。
事件专题

推荐理由:OpenAI开了个针对GPT-5.5的生物安全赏金,发现漏洞能拿钱,搞AI安全的值得关注。
00:46
00:46elvis@omarsar0
用户 @omarsar0 分享一个常用模式:用 Fable 5 作为评估/判断模型,GPT-5.5 作为执行模型,不依赖单一前沿模型,而是花时间做编排、工具和验证。他表示 GPT-5.6 只需直接替换 GPT-5.5 就能纳入该流程。他预告将发布完整教程,并特别对 GPT-5.6 搭配 Fable 5 的效果更期待。
事件专题

推荐理由:有人用 Fable 5 和 GPT-5.5 搭了个 Executor-Advisor 流程,还说 GPT-5.6 来了能直接换上去用,不用等新模型就能更好地编排工具和验证。
7月9日
06:44
06:44Aadit Sheth@aaditsh
76°
OpenAI 推出 GPT-Live,一种支持全双工语音交互的模型。在复杂问题上,它会自动委派给 GPT-5.5 处理。OpenAI 内部网络研究基准测试成绩从 0.7% 跃升至 75.2%。有用户接到餐厅确认电话时发现是 AI 并提问测试,AI 直接挂断,表明体验仍有瑕疵。
事件专题

推荐理由:OpenAI 出了 GPT-Live,能全双工对话还自动叫 GPT-5.5 帮忙算难题,但用户说聊着聊着被挂电话,距离完美还有段路。
03:16
03:16官方账号Decoder@Matthias Bastian
精选
xAI发布Grok 4.5,模型基于数万块Nvidia GB300 GPU训练。在编码基准上,Grok 4.5落后于Fable 5和GPT-5.5,但相比Opus 4.8,token消耗减少4.2倍。Grok 4.5定价每百万输入token仅2美元,远低于竞品。欧盟市场预计7月中旬可用。
事件专题

推荐理由:Grok 4.5每百万token才2美元,编码虽不如Fable 5但便宜到可以忽略差距,性价比碾压。
02:48
02:48官方账号Decoder@Matthias Bastian
74°
OpenAI 推出 GPT-Live 全双工语音架构,允许 ChatGPT 同时听和说。复杂问题会被后台的 GPT-5.5 模型接手,显著提升回答质量。GPT-Live-1 已对 ChatGPT 付费用户开放,免费用户可使用 mini 版。API 访问即将到来。
事件专题

推荐理由:OpenAI 让 ChatGPT 能同时听和说了,复杂问题自动转给 GPT-5.5 处理,对话更自然。付费用户现在就能体验。
02:16
02:16官方一手marktechpost@Michal Sutter
73°
OpenAI 推出新一代语音模型 GPT-Live 和 GPT-Live-1 mini,用于 ChatGPT Voice。GPT-Live 采用全双工架构,能够同时听和说。该模型将搜索与推理任务委托给 GPT-5.5 处理。GPT-Live-1 mini 是轻量版本。
事件专题

推荐理由:OpenAI 用 GPT-Live 把语音交互做到实时全双工,还能让 GPT-5.5 处理复杂推理,听说是你聊天的好帮手。
7月8日
06:17
06:17官方账号Simon Willison’s Weblog博客/媒体
Simon Willison 使用 GPT-5.5 创建了实验性 Web 组件 github-code,仅通过一个提示词构建。该组件接受类似 https://github.com/simonw/sqlite-ast/blob/437c759... 的 URL,自动转换为 https://raw.githubusercontent.com/... 路径,然后用 fetch() 获取并显示指定行范围(如 #L9-L18),带行号但不支持语法高亮。它可直接嵌入网页展示代码片段。
事件专题

推荐理由:Simon Willison 用 GPT-5.5 写了这个 Web 组件,能自动从 GitHub 链接抓取指定行的代码显示在网页上,带行号,做文档或博客嵌入代码很方便。
7月6日
22:31
22:31The Rundown AI@therundownai
Meta展示了名为'Watermelon'的新模型,声称其性能与OpenAI的GPT-5.5相当。Cursor发布了移动版,用户可通过截图直接生成代码修复。联想推出售价44美元的学生AI手机。此外,还有4款新AI工具及社区工作流发布。
事件专题

推荐理由:Meta拿Watermelon对标GPT-5.5,Cursor手机版截图修bug,联想44刀学生AI手机,信息量很足!
14:39
14:39官方账号Simon Willison’s Weblog博客/媒体
sqlite-utils 4.0rc3 是 4.0 稳定版前的第 3 个候选版本。新版本引入了对复合外键的 introspection 和创建支持,这是与 table.foreign_keys 相关的细微破坏性变更。此外,sqlite-utils 现在遵循 SQLite 处理不区分大小写列名的约定。开发者 Simon Willison 使用了 Claude Fable 5 和 GPT-5.5 来协助处理 issue 和 PR。
事件专题

推荐理由:Simon 发布了 sqlite-utils 4.0rc3,主要加了复合外键支持,还修了一堆 issue。用上 Claude 和 GPT 帮忙,少踩不少坑。
7月3日
18:40
18:40AI Will@FinanceYF5
Claude Fable 5 成功在 Godot 游戏引擎中创建了一个蜘蛛侠荡网游戏。与 GPT-5.5 相比,Fable 5 在 Godot 代码生成中产生的错误显著更少。该演示展示了 Fable 5 在游戏开发场景中的编程能力。
事件专题

推荐理由:Claude Fable 5 能把蜘蛛侠荡网变成可玩的 Godot 游戏,而且比 GPT-5.5 少出不少错,做游戏可以试试它。
11:28
11:28官方账号arXiv cs.AI@Zhilin Wang, Han Song, Runzhe Zhan, Jusen Du, Jiacheng Chen, Tianle Li, Qingyu Yin, Yulun Wu, Zhennan Shen, Tong Zhu, Yanshu Li, Guanjie Chen, Derek F. Wong, Yafu Li, Yu Cheng, Yang Yang
EvoPolicyGym是一个基于16个紧凑强化学习环境的基准,用于评测智能体在固定交互预算下迭代改进策略的能力。GPT-5.5在全部16个环境中取得最强综合排名,并在每个环境中进入前两名。该基准还提供轨迹级诊断,分析智能体如何分配预算、将反馈转化为参数调优。结果表明,自主策略演化不仅依赖单次任务胜出,更需在有限反馈下发现任务适配机制并细化策略。
推荐理由:想看看AI智能体怎么自己迭代策略吗?EvoPolicyGym这个新基准让GPT-5.5跑了16个强化学习环境,全部拿到前两名。
7月2日
18:20
06:28
06:28elvis@omarsar0
该推文指出直接对比GPT-5.5与Opus-4.8、GLM-5.2等模型是错误方向,主张将模型组合使用。如果GPT-5.6达到Fable 5性能且无50%限制和7天限制,将给Anthropic带来压力。文中强调未来模型迭代只会提升组合效果。
事件专题

推荐理由:别纠结谁更强了!GPT-5.5、Opus-4.8、GLM-5.2组合用才是新玩法,学会这招直接降维打击。
02:14
7月1日
02:04
6月30日
6月26日
00:27
00:27官方账号Decoder@Matthias Bastian
《华盛顿邮报》的一项调查发现,多数主流AI聊天机器人在政治问题上存在左倾倾向。OpenAI的GPT-5.5在80%的情况下只提供左倾论点。马斯克旗下标榜'反觉醒'的Grok模型也更多偏向左倾。唯一的例外是谷歌Gemini 3.1 Pro,它在93%的测试中呈现了双方观点。
事件专题

推荐理由:想知道你用的AI聊天机器人有没有政治立场?《华盛顿邮报》测了GPT-5.5、Grok和Gemini 3.1 Pro,结果左倾现象普遍,连Grok都没逃过。来看看数据。
6月25日
02:12