早读VOL 2026.09.19308

智谱GLM-5.3-FlashX推理速度达200 tokens/s,AI代理与多模态技术持续突破

新加坡·二〇二六年九月十九日 星期六·DAILY · 每早八时

2026年9月19日,AI领域迎来多项重要进展。智谱AI推出的GLM-5.3-FlashX模型,在约10万颗国产加速器上实现每秒200个token的推理速度,基于320亿参数的混合专家(MoE)架构。研究方面,新方法让AI代理更高效探索环境,在代码编辑任务上提升性能;新框架FedQoS在智能汽车中通过资源感知训练门控和QoS感知传输策略,减少76.7%通信开销和26.0%延迟成本。此外,FAMOS模型实现从稀疏观测中预测3D物体关节参数,新框架提升表格结构解析能力,Deep Noir框架可自动发现LLM推理时的最优引导参数。

01

模型发布/更新

3
02

产品发布/更新

3
03

行业动态

3
04

论文研究

3
05

技巧与观点

3
308今日事件
145一手报道
93新模型
79信源
AITOP · 编辑系统自动生成