事件专题 ·官方一手

小米发布 HySparse2:两级 KV 共享让 MiMo-V3 长上下文预填充计算量降约 5 倍

小米 LLM-Core 团队公开了 HySparse2,这是一种面向 MiMo-V3 这类智能体模型设计的混合稀疏注意力方案,核心是两级 KV 共享。在一个 80B-A3B 的 MoE 模型上,处理 1M token 的预填充 FLOPs 相比 Hybrid SWA 降低约 5 倍。该设计针对超长上下文场景下的计算开销问题,属于注意力架构层面的优化。

当前结论

小米 LLM-Core 团队搞了个 HySparse2 稀疏注意力,1M token 预填充计算量降约 5 倍,做长上下文的可以看看。

2 个信源58° AI 热度最后更新 2026/9/24 02:00:12

证据链

2 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。