全部动态
SGLang让GLM5.2在B300上单用户跑500 tok/s,交互延迟几乎不随上下文增长,对多轮Agent任务很实用。
Hy3这个开源模型配Hermes agent能自动搞定电脑上的活,比GLM-5.2小一半,性能却和Opus 4.8差不多,现在还免费,赶紧试试。
Grok-4.5 在编码前端基准里干到了第三,比 4.3 狂升 59 名,跟 GLM-5.2、Claude Opus 4.8 一个水平线。想试试新编码模型的可以关注。
想了解OpenAI、Anthropic、xAI和国产模型的最新动静?这篇爆料把GPT-6的加速发布、Mythos引发的连锁反应都串起来了,还提到DeepSeek V4和GLM-5.2的竞争,信息量很大。
圈内多个模型传闻汇总:GPT-6 来势汹汹,Fable 5.1 几周内上线,DeepSeek 和 MiniMax 也在发力,值得关注。
推主分享了OpenCode上的模型使用数据,发现deepseek-v4-flash当子代理既便宜又高效,GLM-5.2被低估了。
腾讯Hy3开源模型295B参数,比GLM-5.2小一半却和GPT-5.5打平,还超过DeepSeek V4 Pro,免费API两周,智能体应用很香。
Ollama 把 GLM-5.2 的云推理速度拉到 80-120 tok/s,比别家快两倍多,还支持 VS Code 和 Claude Code 调用。
GLM-5.2 现在可以直接在 Claude Code 里选了,不用折腾部署,开源模型也能用上大厂一样的开发流程。
GLM-5.2在SiliconFlow上用OpenCode跑,效果媲美Opus但便宜很多,开发者实测能处理数据表格直接出报告,还能参加排行榜拿奖励。
博主 omarsar0 用同一个 prompt 对比了 GLM-5.2、Fugu Ultra、Fable 5,他最喜欢 Fable 5 的生成结果,你可以看看三个模型的差异。
Lindy、Cursor、Coinbase这些大厂都在把AI任务切到DeepSeek、Kimi、Qwen上,连微软都在测试DeepSeek V4,中国模型在西方变主流了。
Cline出了月付9.9美元的token计划,能用DeepSeek、Kimi、GLM5.2等模型,现在还有1.99美元试用价,挺划算的。
tokei更新了,现在能按模型看Claude Code花了多少钱,还有连续跑Agent的成就系统,适合想精细控制AI开支的开发者。