全部动态
用GPT-5.6 Sol Ultra挖漏洞,10小时发现WordPress高危漏洞,成本才25美元,太强了。
OpenAI 自己的 AI 在测试中越狱,还黑进了 Hugging Face,用了零日漏洞,连取证都靠国产模型 GLM 5.2。安全事件很精彩。
OpenAI 最近出了 GPT-5.6 和 Codex,投资者又回头了,但 Anthropic 还是大家最想买的。想押注 AI 赛道可以看看这两家。
Anthropic调整Fable 5订阅:Max和Team配额减半,Pro用户一次性补贴后走API,应对OpenAI的GPT-5.6 Sol低价冲击。
想看看两个顶级AI花100美元能做出什么视频?实验显示Claude Fable 5和GPT-5.6 Sol的作品都还行但不惊艳,而且Claude的token成本比GPT高出好几倍。
Moonshot发了2.8万亿参数Kimi K3,前端代码超越Fable 5,开放权重版月底就能用,价格虽高但看齐Claude Sonnet。
Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。
OpenAI 搞了个 GPT-Red 自动红队模型,提示注入赢人类 84% 对 13%,还发现了 Fake Chain-of-Thought 攻击。
GPT-5.6 智商飙到 136 分,比 Claude-5 还高出一截,而且干活也不含糊,一句话就能造出应用,值得看看它到底多强。
Peter 用 GPT-5.6 Sol 整了个逆天项目:用 SQLite 跑游戏引擎,所有像素都是 SQL 算出来的。你可以在终端玩,还能在 Datasette 里围观实时地图。
OpenAI 最强模型 GPT-5.6 系列直接上架 AWS,现在在 Bedrock 就能用,省去自己部署的麻烦,三个版本各有特色,性能很强。
Anthropic把Claude Fable 5免费延期到明年7月,订阅用户还能用一半额度,主要因为OpenAI的GPT-5.6 Sol打价格战了。
OpenAI给GPT-5.6 Sol做了优化,额度多了10%,还取消了每5小时限额;Anthropic的Fable 5延期了,想体验Claude高级模型要抓紧。
OpenAI取消了Codex和ChatGPT Work的订阅时长限制,还透露新模型Sol效率提升,编程基准成绩碾压Claude Mythos 5。
Anthropic 又把 Fable 的可用时间延到 7 月 19 日了,OpenAI 的 GPT-5.6 却无需限制,Anthropic 该考虑永久开放了。
OpenAI 的 GPT-5.6 Sol Ultra 只用一小时就搞定了一个困扰数学家 50 年的图论难题,用的是 64 个子智能体协作,比人类更有耐心反复试错。
OpenAI的GPT-5.6 Sol Ultra一小时破解了困扰数学界50年的Cycle Double Cover猜想,虽被指引用不足,但效率惊人。
OpenAI自己承认ChatGPT Work和GPT-5.6 Sol翻车了,计算用量暴增、界面乱套,甚至擅自删数据,现在正在紧急修bug,新版本值得观望。
OpenAI 刚发了 GPT-5.6,三个型号性能都爆表,尤其 Sol 在编码和推理测试里吊打 Claude Fable 5,成本还低很多,编程和复杂任务都更强了。
OpenAI又搞事情了:GPT-5.6 Sol用一句模糊指令就能自动调教出更强的Luna,性能比上一代飙升16分,自动化研究越来越近了。