7月10日
02:06
7月9日
19:13
19:13官方账号Decoder@Matthias Bastian
精选
Databricks在其数百万行代码库上测试编程智能体,发现中国开源模型GLM 5.2性能与Anthropic的Opus 4.8相当。每任务成本GLM 5.2为1.28美元,Opus为1.94美元。Databricks计划将GLM 5.2作为日常编程工作主力。该公司认为没有单一供应商占主导地位,企业应自建基准而非依赖公共基准。
事件专题

推荐理由:Databricks选了国产开源模型GLM 5.2当默认编程引擎,每花1.28美元能干出Opus 1.94美元的活,省钱了性能还不差。
7月2日
05:47
05:47Fireworks AI@FireworksAI_HQ
GLM 5.2 模型已在 Microsoft Foundry 平台上线。通过 Fireworks AI 的 FireConnect 功能,开发者能使用 Foundry PTUs 将 GLM 路由到 Codex、OpenCode 或 Pi 等工具。该集成旨在帮助团队从零重建工作流并加速开发。开发者现可立即开始使用。
事件专题

推荐理由:Fireworks AI 在微软 Foundry 上推出了 GLM 5.2,还支持用 FireConnect 路由到 Codex、OpenCode,搞工作流开发能快不少,试试呗。
6月30日
6月29日
17:45
17:45Browser Use@browser_use
Browser Use 团队使用 v4 版本构建 QA 基准测试,将 GLM 5.2、Opus 4.7、GPT 5.5 和 Minimax M3 四个模型在 LLM Arena 数据集上的任务进行对比。每个模型生成网站后由人工评估打分,测试涵盖多个任务类型。结果揭示了开源权重模型在特定场景下的表现差异。
事件专题

推荐理由:他们用 Browser Use v4 搞了个新基准,测了 GLM 5.2、Opus 4.7、GPT 5.5 和 Minimax M3,人工打分告诉你谁在 QA 任务上更强。
00:01
00:01官方账号Clement Delangue@ClementDelangue
Brian Armstrong在推文中分享了Coinbase控制AI成本的实践。他提到,通过将默认模型切换到开源模型如GLM 5.2和Kimi 2.7,91%的员工从未触及使用上限。通过改进缓存,LibreChat的缓存命中率从5%提升到60%。这些措施使AI支出减少近一半,同时token用量仍在增长。他还强调路由优化和精简上下文的重要性。
推荐理由:Coinbase创始人Brian Armstrong分享了一套实际操作方案:用更便宜的默认模型、优化缓存和路由,能把AI成本砍半。开源模型GLM 5.2和Kimi 2.7是主角,缓存命中率从5%跳到60%。
6月28日
20:24
20:24官方账号Decoder@Matthias Bastian
精选
Coinbase CEO Brian Armstrong将公司系统切换至中国AI模型GLM 5.2和Kimi 2.7。自动路由系统根据任务和价格选择最佳模型,缓存命中率从5%提升至60%。尽管token使用量持续增长,Coinbase的AI支出已减半。此举凸显西方AI实验室正面临定价压力测试。

推荐理由:Coinbase用GLM 5.2和Kimi 2.7替换了西方模型,成本砍半,缓存命中率翻了12倍。想知道为什么中国模型更便宜?
6月27日
14:24
14:24Marc Andreessen@pmarca
匿名AI研究员FleetingBits剖析了中国AI实验室格局:Zhipu类似Palantir,通过国企合同获得国家支持,其GLM 5.2模型毛利率约40%。MiniMax主打陪伴App Talky和视频生成App Hailuo,多数收入来自海外(含美国)。字节跳动的Doubao是中国最流行的AI应用,但不开源模型。
事件专题

推荐理由:别只盯着DeepSeek了。Zhipu毛利率40%靠国企单子,MiniMax用Talky和Hailuo出海赚美国人钱,字节Doubao闷声发大财——这篇把中国AI家底都抖出来了。
6月26日
11:57
11:57官方一手歸藏(guizang.ai)@op7418
OpenAI模型需经美国政府逐一审核B端客户后方可上线。Anthropic指控中国公司蒸馏其模型。GLM 5.2等事件显示模型发布已类同军民两用战略资产。发布节奏将放缓,准入门槛提高。美国模型公司护城河转向安全合规交付能力。
事件专题

推荐理由:AI模型发布现在要过美国政府审核了,OpenAI和Anthropic的后续动向都会受影响,国内开源模型可能借机上位。
6月25日
05:27
05:27Fireworks AI@FireworksAI_HQ
精选
Fireworks AI 宣布攻克了在前沿模型上使用强化学习时,保持训练和推理数值完全一致(零KLD)的难题。他们将该解决方案作为托管服务提供,首发支持 GLM 5.2 模型。这项服务确保端到端数值对齐,简化了RL训练流程。
推荐理由:Fireworks AI 把强化学习里最头疼的数值一致性问题搞定了,还能直接托管GLM 5.2,省去自己搭基础设施的麻烦。
6月24日
06:03
06:03OpenRouter@OpenRouterAI
OpenRouter 宣布提供 GLM 5.2 模型的所有服务商入口,共列出 20 个提供商。其中一条服务线路的推理速度超过 125 tokens/秒。用户可在单一页面比较并选择不同服务商。这标志着 GLM 5.2 的部署生态进一步开放。
推荐理由:想用 GLM 5.2 但不清楚哪家快?OpenRouter 把 20 个提供商列在一起了,还能直接选超 125 TPS 的那条线。
02:54
02:54Y Combinator@ycombinator
Linzumi AI 发布新功能,允许团队将数十个 AI 编程代理放入同一聊天线程,由 Linzumi AI 自动协调。该功能旨在提升多代理协作效率。同时,通过与 Wafer AI 的合作,限时免费提供开源权重模型 GLM 5.2 的高速访问。GLM 5.2 被描述为 state of the art 的开放权重模型。
推荐理由:Linzumi AI 这个新功能挺有意思,能让你们团队和几十个AI代理在一个聊天里干活,还有免费的GLM 5.2 高速版可以用,试试看。
6月23日
02:26
02:26官方账号LangChain@LangChainAI
LangChain 宣布其通用开发者工具 dcode 现已支持 GLM 5.2 模型。用户可直接在 dcode 中运行该开源模型,无需额外配置。dcode 是提供商无关的工具,也兼容其他最新的开源模型。详情可查阅 LangChain 文档。
推荐理由:LangChain 出了个叫 dcode 的工具,现在能跑 GLM 5.2 模型了,而且是开源的,想尝鲜直接上手。
6月21日
6月20日
16:46
16:46官方一手Pandaily@contact@pandaily.com (Pandaily)
智谱AI的GLM 5.2在Design Arena的HTML网页设计基准测试中超越Claude Fable 5,获得第一名。该模型在第三方库利用方面表现更优,同时具备成本优势。Design Arena基准专门评估AI生成HTML代码的设计质量和功能性。
事件专题

推荐理由:智谱AI的GLM 5.2在网页设计上干掉了Claude Fable 5,库支持更好还更省钱。
10:54
6月19日
12:42
12:42Fireworks AI@FireworksAI_HQ
Jeremy Howard在X平台上称赞Zai_org的GLM 5.2模型,称其至少与Opus 4.8和GPT 5.5一样优秀。他指出该模型速度极快、成本低廉且回答不冗长,在处理长上下文时表现非常出色。Howard表示从未见过如此优秀的开源权重模型。
事件专题

推荐理由:想试试媲美顶级闭源模型的开源模型吗?GLM 5.2又快又便宜,长上下文超强,看看Jeremy Howard怎么夸的。
01:33
01:33官方账号SiliconFlowAI@siliconflowai
精选
Z.ai 的 GLM 5.2 在编码基准 CodeArena 上排名第一。每百万 token 输入缓存/输入/输出价格为 0.26/1.40/4.40 美元,支持 1M 上下文长度。其编码性能与 Opus 4.8 相当,并提供 max 和 high 两种推理模式。该模型已完全开源,可通过 SiliconFlow 的 T+0 合作获取。

推荐理由:Z.ai 的 GLM 5.2 在编码竞技场拿了第一,价格比 Opus 便宜,还有 1M 上下文,编程党可以白嫖开源版。
6月18日
20:22
20:22官方账号vLLM@vllm_project
精选
vLLM 推出新功能,允许用户在自己的 GPU 上运行开源模型作为编程助手。该引擎兼容 OpenAI Responses API,因此任何使用代码助手的工具都可直接指向你的服务器。支持 NVIDIA、AMD 等多种硬件。当前可部署 GLM 5.2、Kimi K2.7 Code、MiniMax M3 等模型。
事件专题

推荐理由:vLLM 现在能让你自己在 GPU 上跑开源模型当编程助手,省了 API 钱还更灵活,支持 NVIDIA、AMD 和多种模型。
6月17日
23:32
23:32Guillermo Rauch@rauchg
Vercel CEO指出,在模型竞争加剧的当下,ai-sdk比以往更重要。开源模型GLM 5.2在Next.js Evals中击败了Opus 4.8。同时Vercel推出eve.dev,提供构建和部署智能体的实用解决方案,类比React与Next.js的关系。
事件专题

推荐理由:Vercel发了eve.dev,帮你快速搞Agent;还有GLM 5.2在Next.js评测里赢了Opus 4.8,开源再进一步。