8月31日
22:07
22:07DeepLearning.AI@DeepLearningAI
78°
GLM-5.3 在人工智能分析智能指数上获得 60 分,与开放权重模型并列第一。该模型通过微调 GLM-5.2 而非重新训练基础架构获得整体智能提升。GLM-5.3 在 CyberGym 基准测试中取得 84.5% 的成绩,展现出高级网络安全能力。

推荐理由:DeepLearningAI 分享 GLM-5.3 如何通过微调实现智能跃升,还意外获得了强大的网络安全能力。
8月26日
06:28
8月20日
07:36
8月19日
23:51
8月15日
02:58
02:58lmarena.ai@lmarena_ai
精选
Z.ai 的 GLM-5.3 即将上线 LMArena 评测平台。官方将对比 GLM-5.1 与 GLM-5.2 的表现。此前 GLM-5.2 在 Agent Arena 的 5 项信号上取得进展,包括任务成功率与用户夸奖/抱怨等隐式反馈。新版本将检验这些改进能否延续。
事件专题

推荐理由:GLM-5.3 要上 LMArena 了,这次直接和前两代同台对比,想蹲 Z.ai 迭代幅度的话可以盯一下。
8月14日
05:19
05:19techcrunch@Russell Brandom
Writer 发布了基于 Z.ai 开源模型 GLM-5.2 的后训练新模型。新系统(基于 GLM-5.2)宣称以更低价格提供部署就绪能力,并升级 harness 控制 token 成本。Writer 表示,该模型延续了 GLM-5.2 的开源生态优势。
推荐理由:Writer 出了新模型,基于 GLM-5.2 改的,价格更低还升级工具省 token 成本,适合想省钱的开发者。
8月11日
12:35
12:35官方账号arXiv cs.LG@Mind Lab, :, Vin Bo, Asher Cai, Jingwei Cao, Song Cao, Vic Cao, Amelia Chen, Andrew Chen, Kaijie Chen, Cleon Cheng, Steven Chiang, Kaixuan Fan, Hera Feng, Huan Feng, Arthur Fu, Jun Gao, Pyke Han, Nolan Ho, Ori Hong, Hailee Hou, Piers Hua, Charles Huang, Miles Jiang, Nora Jiang, Yuyi Jiang, Qiuyu Jin, Fancy Kong, Kuss Koo, Jaron Lee, Andrew Lei, Alexy Li, Dawn Li, Lucian Li, Ray Li, Ricardo Li, Smith Li, Theo Li, Allen Lin, Elliot Lin, Fan Lin, Chen Ling, Kairus Liu, Kieran Liu, Logan Liu, Neo Liu, Xiang Liu, Yuxin Lu, Maeve Luo, Pony Ma, Verity Niu, Cole Qiao, Guian Qiu, Vince Qu, Sentry, Niko Song, Vincent Wang, Bo Wu, Rio Yang, Evelyn Ye, Fiona Ye, Ina Ye, Regis Ye, Josh Ying, Atlas Zeng, Danney Zeng, Salmon Zhan, Anya Zhang, Di Zhang, Mia Zhang, Sueky Zhang, Wei Zhao, Ada Zhou, Adrian Zhou, Yuhua Zhou, Juno Zhu, Murphy Zhuang
Macaron-V1是面向体验智能的开源智能体-模型家族,支持部署后持续学习。旗舰版Macaron-V1-Venti基于744B的GLM-5.2底座,搭配聊天、智能体、编程和GenUI四个LoRA适配器。Macaron-V1-Tall基于Qwen3.6(50B)设计,用于本地部署。系统采用模型-框架协同设计和递归自我改进循环,包含UI4A组件原生GenUI框架和智能体RL框架MindForge。在Personal Intelligence、GenUI和通用能力基准上进行了评估。
推荐理由:想了解怎么让模型部署后还能继续学?Macaron-V1用LoRA组合和递归改进做到了,744B大模型加四个专家LoRA,还开源。
8月5日
16:17
16:17官方一手pandaily@contact@pandaily.com (Pandaily)
独立机构SaferAI对Zhipu GLM-5.2的审计显示,其网络攻击能力与GPT-5.5持平,但缺少内容过滤护栏。审计中76%的安全漏洞可被复现,模型对恶意请求的拒绝率为0%。这一结果暴露了开源权重版本在部署时的结构性风险。

推荐理由:SaferAI测了Zhipu的GLM-5.2,攻击力比肩GPT-5.5,但零内容过滤,开源风险不小。
04:14
04:14techcrunch@Rebecca Bellan
SaferAI发布新报告,评估Z.ai的开源权重模型GLM-5.2。该模型在多项基准上接近前沿闭源模型,但缺少关键安全缓解措施。报告指出,开源模型的快速进展可能超过现有治理与防护机制。
推荐理由:SaferAI的报告说,Z.ai的开源模型GLM-5.2已经快追上顶级闭源模型,但安全防护没跟上,搞开源的朋友得看看。
7月30日
11:29
11:29官方账号arXiv cs.LG@Yihao Chen, Shi Chang, Khaled Chawa, Feng Lin, Boyuan Chen, Shaowei Wang, Ahmed E. Hassan
论文提出 MindForge 自动流程,将开源命令行程序转为仅暴露编译后可执行文件和文档的源码无关环境。用 GLM-5.2 作为教师智能体生成高质量程序合成轨迹,微调 Qwen3.6-27B。微调后模型在 ProgramBench 上平均测试通过率从 37.98% 提升至 49.51%,并在 7 个未见基准上均获提升,如在 RepoZero-C2Rust 上绝对增益 31.00 分、SWE-bench Verified 上 5.04 分。
推荐理由:MindForge 教小模型从零写完整软件,不用源码只用可执行文件和文档就把 Qwen3.6-27B 在 ProgramBench 上提升了 11.53%,跟大模型差不多。
7月24日
13:44
13:44AI Engineer@aiDotEngineer
85°
HuggingFace在两周前遭遇复杂入侵,攻击者是一个完全自主的AI智能体,由未发布的前沿模型驱动。HuggingFace团队使用ZAI的GLM-5.2模型分析攻击痕迹,并得到OpenAI合作调查。该事件恰好印证了Thomas Wolf在AI Engineer World's Fair上关于AI安全与开源模型的演讲。
事件专题

推荐理由:Thomas Wolf讲了个真实故事:HuggingFace被AI智能体入侵,他们用GLM-5.2分析,还和OpenAI联手。比科幻片还刺激。
7月23日
7月22日
17:15
7月19日
21:37
18:43
18:43官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云发布针对个人的Token Plan,统一积分支持文本、图像和视频生成。包含Qwen3.8-Max-Preview、GLM-5.2、DeepSeek-V4-Pro等模型,以及Happy Horse 1.1用于视频生成。首月优惠价仅4美元(使用优惠券后)。该计划提供多模态统一计费方式。
事件专题

推荐理由:阿里云新出的个人套餐,一个Token包圆文本、图像和视频,首月才4美元,性价比不错。
09:48
09:48官方一手marktechpost@Michal Sutter
82°
文章对三款开源万亿参数MoE模型Kimi K3、DeepSeek V4 Pro和GLM-5.2进行了全面对比。对比涵盖了在多项基准测试中的表现、采用的MIT或Modified MIT许可证以及实际服务成本。文章提供了这些模型在不同维度上的差异分析,帮助读者了解各模型的优劣势。
事件专题

推荐理由:想选开源万亿模型?这篇直接拿三个主流模型比了基准、许可证和成本,看完就知道选哪个合适。
7月18日
23:33
08:08
7月17日
00:20
00:20岚叔@lufzzliz
用户付费测评了Kimi-K3和GLM-5.2两个国产模型,认为它们与海外SOTA模型的差距正在缩小。在“托举大力神杯”任务中,Kimi-K3的表现仅次于fable-5模型。测评提到Kimi-K3推理速度较慢,需要付费才能完成测试。GLM-5.2也被评价为“国产之光”。
事件专题

推荐理由:有人真金白银实测了Kimi-K3,发现和海外顶级模型差距缩小了,在特定任务上仅次于fable-5,值得看看具体表现。
7月10日
06:04
06:04Paul Couvert@itsPaulAi
开源模型Hy3与Hermes agent配合可自动化计算机上的任何任务。Hy3比其它开源模型更强,在部分用例上与Opus 4.8持平。其模型大小仅为GLM-5.2的一半,而GLM-5.2此前是最佳编码/智能体开源模型。目前用户可以免费使用。
事件专题

推荐理由:Hy3这个开源模型配Hermes agent能自动搞定电脑上的活,比GLM-5.2小一半,性能却和Opus 4.8差不多,现在还免费,赶紧试试。