8月28日
20:44
20:44阮一峰的网络日志博客/媒体
精选
大模型通过参数机制将人类知识压缩在无数参数中,如GLM 5.3拥有7440亿个参数。推理机制让模型根据已有知识推断新知识,而不必存储所有信息。联网机制则帮助模型获取参数和推理都无法覆盖的实时信息,如股票指数。

推荐理由:这篇文章用通俗方式解释了AI工作的三种核心机制,让你明白大模型如何回答问题。
8月27日
12:03
12:03官方一手歸藏(guizang.ai)@op7418
精选
Codepilot 0.67.10 更新,优化模型选择器,支持收藏模型和渠道;修改右侧边栏交互,支持文件树、看板;内置浏览器升级,支持固定Tab;支持GLM 5.3;支持Windows自动更新与增量更新。
事件专题

推荐理由:Codepilot更新了,这次增加了模型收藏和浏览器固定Tab功能,用起来更方便了,值得一试!
8月20日
14:45
14:45官方账号Latent Space (swyx)博客/媒体
Z.ai首席执行官Jie Tang针对GLM 5.3模型版本发表看法;他介绍了新的Post-training Scaling Law及其应用场景;该定律对比传统方法,在模型训练效率上表现更优。
事件专题

推荐理由:Z.ai的老总讲了GLM 5.3和那个新定律,讲清楚和以前不一样的地方,你去听听了解下。
8月17日
07:26
07:26Guillermo Rauch@rauchg
精选
Vercel对GLM 5.3进行了网络安全能力评估。该模型在DeepsecBench基准中得分最高,是开源模型中的第一名。其运行成本仅为分数相近的专有模型的1/3。这使得防御性安全任务可以至少3倍频次地运行deepsec.sh脚本。
事件专题

推荐理由:Vercel测了GLM 5.3,网络安全评分是开源模型里最高的,价格只要别家三分之一,跑deepsec.sh能多跑三倍,防御岗可以关注。
8月16日
17:44
17:44官方一手歸藏(guizang.ai)@op7418
精选
CodePilot 适配了 Grok 4.6、DeepSeek V4 Pro 和 GLM 5.3 三款新模型。用户可以将 Grok 会员中的图像模型与视频模型额度直接用于 CodePilot。该工具还新增了 Twitter 检索功能。持有 Twitter 会员的用户,无需额外付费即可调用 Grok 的图像、视频生成及检索服务。
事件专题

推荐理由:CodePilot 现在能白嫖 Grok 的绘图和视频模型,只要有 Twitter 会员就行,还支持检索推文,挺划算的。
8月15日
03:41
03:41lmarena.ai@lmarena_ai
GLM 5.3 现已出现在 arena.ai 的测试入口。用户可在 Battle Mode 中直接对比模型表现,也可在 Agent Mode 下尝试智能体场景。该入口由 @arena 在 X 上发布,目前帖子有 0 条评论、1 次转发和 194 次浏览。
事件专题

推荐理由:arena 官方在 X 上给了 GLM 5.3 的测试链接,能直接进 Battle 和 Agent 模式试试手感,想玩模型的可以点开看看。
8月10日
14:00