阿里云发了个 2.4T 参数的开源模型 Qwen 3.8 max preview,性能接近 Fable 5,首月才 4 美元,还能在 Claude Code 里用,可以试试。
全部动态
SGLang让GLM5.2在B300上单用户跑500 tok/s,交互延迟几乎不随上下文增长,对多轮Agent任务很实用。
Hy3这个开源模型配Hermes agent能自动搞定电脑上的活,比GLM-5.2小一半,性能却和Opus 4.8差不多,现在还免费,赶紧试试。
Grok-4.5 在编码前端基准里干到了第三,比 4.3 狂升 59 名,跟 GLM-5.2、Claude Opus 4.8 一个水平线。想试试新编码模型的可以关注。
想选行业AI模型?Claude Fable 5 碾压全场,但成本是 DeepSeek V4 Pro 的百倍,性能只多 12 分,性价比得掂量。
圈内多个模型传闻汇总:GPT-6 来势汹汹,Fable 5.1 几周内上线,DeepSeek 和 MiniMax 也在发力,值得关注。
推主分享了OpenCode上的模型使用数据,发现deepseek-v4-flash当子代理既便宜又高效,GLM-5.2被低估了。
腾讯Hy3开源模型295B参数,比GLM-5.2小一半却和GPT-5.5打平,还超过DeepSeek V4 Pro,免费API两周,智能体应用很香。
GLM-5.2 现在可以直接在 Claude Code 里选了,不用折腾部署,开源模型也能用上大厂一样的开发流程。
GLM-5.2在SiliconFlow上用OpenCode跑,效果媲美Opus但便宜很多,开发者实测能处理数据表格直接出报告,还能参加排行榜拿奖励。
博主 omarsar0 用同一个 prompt 对比了 GLM-5.2、Fugu Ultra、Fable 5,他最喜欢 Fable 5 的生成结果,你可以看看三个模型的差异。
GLM-5.2 在社区投票的编码竞技场上压过 Claude Opus,你可以在前端任务中试试它的单次生成效果。
NVIDIA 把智谱的 GLM-5.2 量化成 NVFP4 精度,放 Hugging Face 上免费调,还能白嫖,日常推理够用了。
Fireworks和Faros拿真实工程任务实测GLM-5.2,结果比Opus 4.8和GPT-5.5都更便宜更快,得分还高。想为代码任务选模型可以看看这个。
Zai_org的GLM-5.2开源模型在前端编码上超过了Opus,离领先的Claude Fable只差一点,值得试试
Unsloth把GLM-5.2压到1-bit,Mac Studio上跑21 tok/s,创意性居然不输Claude Opus,本地部署党有福了。