8月26日
22:58
8月25日
20:33
20:33官方账号Decoder@Maximilian Schreiner
精选
Nvidia 的 Groq 3 LPX 推理芯片进入量产,Gemma 4 31B 上每秒处理 3,400 个 token,是 Cerebras 的四倍。但需要至少 64 个加速器,而 Cerebras 只需一个或两个,架构在大 MoE 模型上的扩展性仍待定。
事件专题

推荐理由:Nvidia 的 Groq 3 LPX 芯片在性能上超越了 Cerebras,但需要更多加速器,了解其扩展性如何。
00:40