8月20日
23:38
23:38宝玉@dotey
Together AI 工程师哈桑分享了用智能体设计 UI 的经验。他开发了名为 Hallmark 的 design skill,将 AI 常见的“slop 套路”列为“别这么干”的规则喂给模型。他建议给智能体提供参考图和截图,并使用更长的提示词。他提到 GLM 5.2 的效果与 Opus 几乎分不出来,但速度更快。
推荐理由:Together AI 工程师哈桑分享了用智能体设计 UI 的经验,他做了个叫 Hallmark 的 design skill,把 AI 常见的“slop 套路”列为“别这么干”的规则喂给模型,效果很好。
7月31日
18:08
18:08orange.ai@oran_ge
DeepSeek V4 Flash 已上架 Cola 平台,支持 Token Plan 和积分模型两种计费方式。该模型的智能表现被描述为超过 GLM 5.2,接近 GPT 5.6 Luna。目前用户可通过 colaos.ai 免费体验这一模型。
事件专题

推荐理由:DeepSeek V4 Flash 在 Cola 上线了,免费就能玩,智能比 GLM 5.2 强,都快赶上 GPT 5.6 Luna了。
7月29日
12:27
12:27官方一手歸藏(guizang.ai)@op7418
精选
Codepilot 推出了 Subagent 功能,允许用户在一个聊天中启用多个由不同模型驱动的子智能体。例如可用 Grok 检索 Twitter 信息、DeepSeek 生成文案、K3 生成网页、GLM 5.2 统筹。该设计旨在发挥各模型长处,同时减少昂贵模型的消耗,降低使用成本。

推荐理由:Codepilot 这个 Subagent 功能真香,一个聊天里混用 Grok、DeepSeek、GLM 5.2 等模型,各取所长还省钱,试试看。
12:26
12:26官方一手歸藏(guizang.ai)@op7418
作者使用 Codepilot 的一条提示词,让 Grok 爬取 Twitter 信息、Kimi 生成网页、DeepSeek 撰写文案,并由 GLM 5.2 统筹。该 workflow 成功完成昨天 AI 热点事件统计,时效性与人工搜集相当,甚至补充了漏掉的信息。通过分模型调用,降低了昂贵模型的消耗。

推荐理由:想用最少的成本让不同模型干各自擅长的事?参考这个 workflow:Grok 爬推文、DeepSeek 写文案、Kimi 做网页、GLM 5.2 调度。
7月24日
00:45
00:45berryxia@berryxia
开发者将Kimi的MoonViT视觉编码器挂载到GLM 5.2文本模型上,形成可用的视觉版本。该项目开源了NVFP4量化权重,展示了插件式多模态组装的有效性。MoonViT编码器可独立复用,GLM 5.2快速获得看图能力,无需从头联合训练。
推荐理由:有人把Kimi的视觉编码器接到GLM 5.2上,开源了量化权重,让GLM 5.2能看图片了。这种插件式玩法很实用。
7月22日
18:37
18:37@koltregaskes@koltregaskes
82°
Hugging Face 在内部网络安全测试中被 OpenAI 模型攻击,产生超过 17000 条记录。调查时,美国闭源模型因安全护栏拒绝分析攻击数据。HF 改用中国开源模型 GLM 5.2 在自有基础设施上完成取证,数小时而非数天内完成。攻击者代理无限制,防御方反被护栏阻碍,揭示开放权重的优势。
事件专题

推荐理由:Hugging Face 被自家 AI 测试模型攻破后,想查案却被美国闭源模型拒绝帮忙,最后靠中国开源模型 GLM 5.2 几小时搞定。开放权重 vs 护栏,看完你就懂为什么本地跑模型更安全。
10:27
10:27官方一手Pandaily@contact@pandaily.com (Pandaily)
精选
MindLab发布Macaron-V1,一种基于混合LoRA的后训练方法,应用于GLM 5.2。该方法包含4个专门的1B参数专家适配器,支持2M token上下文扩展。通过RL训练,748B参数的Venti变体仅用64块GPU即可完成训练,显著降低万亿参数模型的后训练成本。

推荐理由:MindLab用Macaron-V1在64块GPU上训出748B模型,比传统RL省资源,适合想低成本强化大模型的人
7月21日
7月19日
21:27
21:27shao__meng@shao__meng
DeepSeek V4 和 GLM 5.2 已发布。本周 Kimi K3 和 Qwen 3.8 曝光,对标 Claude Fable 5 和 GPT-5.6 Sol。Tencent Hy3 提升很大,MiniMax M3 落后但后续期待。Gemini 3.5 Pro 原定7月17日发布,因内部评估未通过而推迟。
事件专题

推荐理由:这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
7月13日
11:17
11:17官方账号Together AI@togethercompute
精选
GLM 5.2 模型在 Together AI 平台部署后,在 Artificial Analysis 评测中输出速度和延迟均获得第一名。该评测覆盖多个主流模型,GLM 5.2 在吞吐量和响应时间指标上表现领先。Together AI 通过优化推理栈使模型达到接近实时的生成速度。

推荐理由:GLM 5.2 在 Together AI 上跑出了最快速度和最低延迟,想用低成本跑推理的话可以去试试这个组合。
09:05
09:05官方账号Greg Brockman@gdb
87°
OpenAI的GPT-5.6 Sol在Design Arena中以Elo 1353排名第一,超过Anthropic的Claude Fable 5。它和智谱的GLM 5.2处于同一性能区间(前端设计)。相比GPT-5.5,GPT-5.6 Sol提升了18个名次和60分Elo。该模型还建立了偏好与速度的新帕累托前沿,比同性能级别模型更快。
事件专题

推荐理由:OpenAI新模型GPT-5.6 Sol在网页设计评测中拿了第一,比上一代强很多,还比Claude Fable 5更快。想看看AI设计的新天花板吗?
7月11日
05:58
05:58Aravind Srinivas@AravSrinivas
精选
Perplexity CEO透露其自研编排器架构,基于GLM 5.2模型进行后训练。在需要时,系统会升级到Opus模型作为顾问。该编排器将利用更多计算资源快速提升质量。同时,Grok 4.5和Opus Fast也被认为是优秀的编排模型。
推荐理由:Perplexity CEO揭秘自家搜索背后的模型编排:用GLM 5.2后训练,必要时上Opus,比Grok 4.5和Opus Fast还强?
7月10日
19:58
03:46
03:46Guillermo Rauch@rauchg
Vercel将Meta的Muse Spark 1.1多模态推理模型集成到AI Gateway中。该模型专为智能体任务设计,兼具高速推理和高智能水平。同时,Grok 4.5和GLM 5.2可能在本周发布,预计将显著分走token市场份额。当前是使用AI Gateway的好时机。
推荐理由:Vercel把Meta的Muse Spark 1.1接入AI Gateway,这是个专门干智能体任务的又快又聪明的多模态模型,你值得试试。