MiniMax发布了Music3音乐模型,给歌词和描述就能生成5分钟完整歌曲,前奏副歌桥段都有,比常见几十秒的音乐生成更完整。
想用最强开源编程模型的可以蹲一下,GLM-5.3 纯靠后训练就把 Terminal-Bench 分数翻了 6 倍,两周后开放权重。
谷歌把 Gemini 3.7 Flash 价格砍到 3.6 的一半,编程和智能体场景变强了,还直接给 Spark 用上,搞开发可以试试。
OpenAI 给最强模型 GPT-5.6 Sol 上了个超快模式,每秒能出 750 个词元,比原来快 14 倍,适合客服、金融这些要抢时间的活儿。
Writer 出了新模型,基于 GLM-5.2 改的,价格更低还升级工具省 token 成本,适合想省钱的开发者。
谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
谷歌新出的Gemini 3.7 Flash,编码和智能体分数提升明显,输入每百万token只要0.75美元,划算,但只走API。
DeepSeek把V4 Pro转正,开源了Harness v0.1,但缓存涨价到6倍,跑智能体工作流得多算算账。
OpenAI可能藏了个新生图模型,代号mona-lisa-1,盲测里细节比GPT-Image-2还多,但还没正式发布,可以先围观。
DeepSeek把新模型和Harness框架一起开源了,权重MIT可自建,代码能力干到87.9分,直接对标Claude Code。
Dyna Robotics把100万小时人类视频喂给机器人模型,搞出了Dyna-2,还验证了缩放定律能跨界到机器人数据,看它怎么做到跨实体泛化挺有意思。
DeepSeek 又发新版本了,V4 Pro 正式版 API 已上线,智能体能力更强,还支持 Codex,性能直逼 Fable 5。
DeepSeek 新模型只走 API,OpenRouter 上能直接试。三档推理等级画出来的鹈鹕都不一样,想玩可以拿同一道题对比看看。
Dyna Robotics 拿 170 年人类视频训了个机器人模型,成功率能到九成,比上代翻倍,搞具身智能的值得看看。
Upstage 发了主打智能体任务的 Solar Pro 4,定价不高,Agent Arena 排名和 MiniMax M2.7 同级,适合处理长文档和多轮工具调用。
xAI 的 Grok 4.6 跑分追平 GPT-5.6,智能体任务比 Claude 更省步数,价格还便宜一大截,想换 API 的可以看看。
微信自己搞的 WeLM 80B 已经在小微里落地了,617B MoE 版也在路上,做微信生态开发的可以盯一下。
DeepSeek V4 Pro 正式版来了,Agent 能力增强,支持 Codex 接入,跑分直逼 Fable 5,用 API 的可以试试。
SpaceXAI 的 Grok 4.6 发布,跑分追平 GPT-5.6 Sol,长流程编程和搭应用更强,已上线 Cursor,首周额度翻倍。
阿里开源了Qwen3.8-2.4T-A95B,2.4T参数激活95B,原生256K上下文,编程和Agent能力对标GPT 5.6 Sol和Opus 4.8。
比亚迪AI团队首秀,HyWorldVLA在自动驾驶基准上拿了第一,还自研了4nm芯片,算法硬件一起搞,想了解比亚迪智驾实力的可以看看。