Hugging Face 老板在安理会讲自家被 AI 攻击的经过,闭源 API 拦着不让用,最后靠中国的开源模型 GLM 5.2 才防住,观点挺有意思。
智谱Zhipu AI
中国·Beijing
GLM 系列模型,国际品牌 Z.ai
在做什么
智谱 2019 年由清华大学技术成果转化成立,总部在北京,开发 GLM 系列大模型和智谱清言助手,国际业务使用 Z.ai 品牌。
最近动态
信息流里提到这家公司的条目Hugging Face CEO 在联合国安理会分享遭 AI 智能体网络攻击的三点教训
Bolt Forge 一周数据:GLM 5.3 Flash 与 DeepSeek V4.1 Flash 占八成请求
Bolt 公了一周真实用量:GLM 5.3 Flash 占 63%,DeepSeek Flash 17%,用户宁可要快的也不挑最大的,这个数据挺说明问题。
Step 5 Preview 实测:发动机动画与三维抓娃娃机两个编程任务对比
Step 5 Preview 刚发布,作者拿发动机动画和3D抓娃娃机两个任务实测它,和 GLM-5.3、DeepSeek-V4.1-Flash、GPT-5.6 Sol 逐项对比耗时和成品质量,比看跑分实在。
StepFun 开源 Step Code,Terminal-Bench 2.1 得分 80.9%
StepFun 把自家 Coding Agent 开源了,跑分还行,作者顺手整理了国内各家开源编程 Agent 的 GitHub 链接,选型可以直接抄。
小米开源全模态模型 MiMo-V2.6:AA 指数 46 分超 Kimi K3
小米把 MiMo-V2.6 权重全开源了,Pro 在 AA 指数拿 46 分压过 Kimi K3,价格只有海外模型的 1/20。
IT之家原文
arXiv 论文提出 opinion leader dynamics,解释稀疏注意力如何塑造 token 聚类
把 token 当粒子建模,还拿 Kimi-K3 和 DeepSeek-V4-Flash 实测验证,讲清稀疏注意力为啥省算力还不丢效果。