#推理模型
GPT-5.6 来了,带着 Work IQ 直接进微软全家桶,Copilot、GitHub 都能用,推理更强还支持多步智能体任务,赶紧试试。
OpenAI 的 GPT-5.6 新系列在智能体考试中大幅领先 Claude Fable 5,成本还低很多,值得看看。
这篇论文打脸了“超级权重”的主张:单独训练它们反而让模型崩成随机猜,而LoRA用极少的参数就能搞定。想了解模型微调真正该关注什么,必看。
这篇论文提出了Latent Memory Palace方法,把推理当成自回归变分推断来控制机器人,在模拟和现实任务都很强,还带可变长动作分词器,做控制方向的朋友可以看看。
OpenAI 出了三个 GPT-5.6 模型,Sol 冲前沿、Terra 干日常、Luna 省成本,Genspark 上直接能用,选一个试试。
OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。
CodeRabbit实测了GPT-5.6的两个版本,Sol在代码审查中召回更强,Terra则更省钱。对比Fable 5和Opus 4.8,想升级编码工具可以看。
GitHub Copilot 现在能用 GPT-5.6 了,分三个版本:Sol 专治复杂推理,Terra 日常够用,Luna 省成本又好使。
OpenAI 刚发了 GPT-5.6 三个版本,Sol/Terra/Luna 各有侧重,还上了程序化工具调用和多智能体 beta,搞 Agent 的赶紧摸摸。
想省钱又想有GPT-5.5级别编码和推理能力?试试OpenRouter的GPT-5.6 Terra,价格腰斩,性能不减。
Meta 新出的 Muse 在 agent 任务上直追 GPT-5.5,还有 1M 上下文和主动记忆管理,跑长任务再也不怕忘事了。
Meta 出了新模型 Muse Spark 1.1,带了 Thinking 模式,可以去 meta.ai 或者 App 里试试效果。