OpenAI 的 GPT-5.6-Sol 不只是聊天,能直接干复杂编程活了,比如自己重构 Next.js 服务器。想看看模型实际生产力有多强?这篇实测值得看。
全部动态
腾讯Hy3开源模型295B参数,比GLM-5.2小一半却和GPT-5.5打平,还超过DeepSeek V4 Pro,免费API两周,智能体应用很香。
多家AI公司扎堆预告新模型,Grok 4.5、GPT-5.6 Sol、Claude Fable 5这些名字你都得知道。
GPT-5.6 来了,参数 2-4T,带 Ultracode 推理层级,还有 Cerebras 版速度飙到 750 tokens/s。想试试新模型的可以关注了。
OpenAI 周四就要上线 GPT-5.6 的全新系列 Sol、Terra 和 Luna,现在就能申请预览,赶紧试试。
Bleys 算了一笔账:GPT-5.6 Sol 参数 2-4 万亿、跑在 Cerebras 晶圆上、速度 750 token/s,但价格可能翻倍。想了解下一代超大规模模型怎么造?看这个。
OpenAI 把 GPT-5.6 Sol 放到 Cerebras 上跑,推理速度飙到 750 tokens/s,比常规部署快很多,适合追求低延迟的场景。
OpenAI悄悄改了ChatGPT的logo,蓝底黄标可能暗示新模型系列Sol/Terra/Luna,看看他们葫芦里卖的什么药。
OpenAI 下周可能发 GPT-5.6,配额更宽松,专门抢 Claude 用户。同时 Gemini 3.5 Pro 也跳票到 7 月 17 日。想了解前沿模型动态的可以关注。
Claude Fable 5 能把蜘蛛侠荡网变成可玩的 Godot 游戏,而且比 GPT-5.5 少出不少错,做游戏可以试试它。
OpenAI和Anthropic现在每1-2个月发一次新版,谷歌要75天还断过154天,速度差距越来越大了。看看他们怎么用发布节奏建护城河。
编程Agent技能选不好?这篇论文用自回归解码一次搞定技能组合和顺序,在SkillsBench上直接涨了18到23个点,比传统检索还省token。
OpenAI 搞了个新基准 GeneBench-Pro,专门测模型做复杂生物分析时的判断力,GPT-5.6 Sol 表现很亮眼,比之前强不少。
Anthropic 的 Fable 5 和 Mythos 5 解禁了,但有政府安全条件。OpenAI 的 GPT-5.6 也被限制,引发业界对管制拖慢创新的讨论。
Anthropic 出了 Sonnet 5,能自己规划任务、用浏览器和命令行,比 Sonnet 4.6 强,但比 Opus 便宜,适合想搞 Agent 又不想花大钱的人。
Anthropic的Sonnet 5来了,Agent能力接近最贵的Opus,价格才40%。以前会卡住的复杂任务现在能跑完,还自己检查输出。默认模型升级值得一试。