DeepEP是DeepSeek开源的面向MoE模型的专家并行通信库,专门解决大型语言模型在多GPU环境下的通信效率问题。近期,DeepEP在GitHub上获得了超过9600个星标,成为AI社区关注的热点项目。
DeepEP
general · 首次出现 2026-05-22 · 最近出现 2026-09-30 · 累计提及 30
综述
相关报道
10 条在档- DeepSeek开源TileLang等华为昇腾版本pandaily
- DeepSeek开源昇腾版基础组件Lxfater
- DeepSeek开源昇腾算力平台基础设施组件IT之家
- 在 Amazon EKS 上用 EFA 与 DeepEP 扩展 MoE 强化学习,吞吐量提升 40%AWS Machine Learning Blog
- MoK 在 Cursor 支撑数万 GPU 训练,吞吐提升至 1.41 倍Cursor
- vLLM v0.24.0 发布:支持 MiniMax-M3 和 DeepSeek-V4vLLM
- LLMs写单GPU内核快,多GPU就崩溃Together AI
- 改进DeepEP MoE负载均衡:SGLang引入Waterfill和LPLBLMSYS Org (SGLang)
- 英伟达MoE新开源:一行import,微调加速3.7倍量子位
- NVIDIA NeMo AutoModel 基于 Hugging Face Transformers v5 实现 MoE 训练加速 3.4-3.7 倍NVIDIA AI