产品Agent 与开发者精选04:18AMD 将在 PyTorch 大会展示 MoRI + vLLM 跨 pod 的 MoE 推理方案AMD 把 MoRI 通信栈接进 vLLM,让 MoE 推理能跨 pod 用 RDMA 分摊专家和搬 KV cache,搞大模型部署的可以看看基准数据。#vLLM#AMD Instinct#MoRI#MoE官方账号PyTorch@PyTorch原文稍后读已读值得跟进有用关注 vLLM