15:59AI Will@FinanceYF5中国顶尖代码模型GLM5.2和Qwen3.7 Max的混合定价约1美元/百万token,而美股同档位SOTA模型定价在4-8美元。高盛测算显示,价值型Agent模型目前EBIT利润率为-30%,代码模型为-39%,企业依靠账上现金扛亏损,预计到2030年才能转正。行业GLM5.2Qwen3.7 Max代码模型推荐理由:GLM5.2和Qwen3.7 Max比美股便宜4-8倍,但还在亏本卖。高盛说代码模型利润率-39%,国内价格战打到2030年才止血,做AI应用的朋友该算算这笔账。原文稍后读已读值得跟进有用关注 GLM5.2
15:36AI Will@FinanceYF571°高盛报告指出,中国顶级编码模型GLM5.2和Qwen3.7 Max的每百万混合token成本约1美元,而美国SOTA模型为4-8美元。中国模型以低于成本价销售,高盛估计当前智能体模型EBIT利润率为-30%,编码模型为-39%,预计到2030年分别转为+14%和+22%。架构上,DeepSeek V4 Pro仅激活1.6T参数中的49B(<8%),GLM5.2激活744B中的40B,更低的FLOPs提供了价格下限。在OpenRouter上,中国模型按任务花费占比仅5-16%,但占据了85%的智能体token和89%的编码token。基准SDLLMTK从6月初约2.07降至当前1.67。行业GLM5.2Qwen3.7 MaxDeepSeek V4 Pro2 个信源在谈事件专题推荐理由:高盛给LLM经济学算了笔账:中国模型靠架构优势把价格打到美国1/4,但还在亏本卖。想搞清模型定价走势的可以看。原文稍后读已读值得跟进有用关注 GLM5.2
00:58向阳乔木@vista8精选一位开发者对比了多个编程工具和模型:Codex排第一,配合Computer use和Browser use内置生图功能,长程任务偷懒少;Claude Code第二,其Fable5模型前端审美好但产品生态不如Codex;Zcode因GLM5.2进入可用工具行列;今日发布的Grok 4.5让Grok cli加入可用工具,Cursor也被加强。AI产品CodexClaude CodeZcode10 个信源在谈事件专题推荐理由:一位开发者分享了Codex、Claude Code、Zcode等编程工具排名,还提到刚发布的Grok 4.5,看看他的对比。原文稍后读已读值得跟进有用关注 Codex
19:36向阳乔木@vista8GLM5.2 是智谱 AI 近期发布的模型。有用户将其输出风格与 Anthropic 的 Claude 对比,认为两者相似。该讨论在 X 平台引发关注。AI模型GLM5.2Claude智谱AI10 个信源在谈事件专题推荐理由:有网友说 GLM5.2 用起来像 Claude,好奇的话可以去看看具体怎么回事。原文稍后读已读值得跟进有用关注 GLM5.2
09:29官方一手arXiv: DeepSeek@Zewen Liu该论文首次研究评估器校准作为缓解方法,对DeepSeek-V4-Pro执行器和GLM5.2评估器进行受控实验。结果显示,校准将耦合系数gamma降低20-49%,Jensen-Shannon散度降低45-67%。对称LR控制实验确认效果并非来自更新不对称性减少。作者发布了校准TTRL协议,推荐作为轻量级缓解方案。论文DeepSeek-V4-ProGLM5.2TTRL推荐理由:这篇论文实验发现,对评估器做概率校准能把偏好耦合降低20-49%,效果显著,推荐给做LLM评估管线的朋友。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro
18:26Yangyi@YangyixxxxGLM5.2在前端审美能力上有显著进步,用户评价其表现接近Claude。该模型可能通过优化视觉布局和UI设计来增强用户体验。目前尚无公开基准测试结果,但社区对其潜力表示关注。AI模型GLM5.2Claude前端审美推荐理由:GLM5.2的前端审美变强了,有人说快赶上Claude了,做UI设计的朋友可以留意一下。原文稍后读已读值得跟进有用关注 GLM5.2
10:57Viking@vikingmuteGLM5.2在Artificial Analysis开源模型排名中登顶,多项benchmark评分领先。有用户反馈其实际体验接近Opus 4.6,作者考虑将Deepseek V4 Pro替换为GLM5.2。该帖子获得2条回复、505次浏览。AI模型GLM5.2Artificial AnalysisOpus 4.62 个信源在谈事件专题推荐理由:GLM5.2在开源模型排名拿了第一,而且有人说用起来感觉像Opus 4.6,你要是想换掉Deepseek V4 Pro可以试试。原文稍后读已读值得跟进有用关注 GLM5.2