模型官方一手精选

NaiveAI 开源 Naive-N0.5-Flash:309B MoE,原生 1M 上下文

NaiveAI Open-Weights Naive-N0.5-Flash: 309B MoE, Hybrid SWA–DSA 1M Context, MIT

精选理由

NaiveAI 放出了 MIT 协议的 309B MoE 开源模型,激活参数只有 15.5B,还能吃下 1M 上下文,做长代码分析可以试试自己部署。

NaiveAI 以 MIT 许可证开源了 Naive-N0.5-Flash 权重。该模型为 309B 参数的 MoE 架构,每次激活 15.5B 参数。它采用混合 SWA–DSA 注意力机制,原生支持 1M token 上下文,且不含全注意力层。模型基于 MiMo-V2.5 构建,面向编程和 AI 研发场景。

原文 · pandaily

NaiveAI Open-Weights Naive-N0.5-Flash: 309B MoE, Hybrid SWA–DSA 1M Context, MIT

NaiveAI released Naive-N0.5-Flash as MIT open weights: a 309B MoE with 15.5B active, hybrid SWA–DSA native 1M context for coding and AI R&D, built on MiMo-V2.5 without full-attention layers.