№qwen330ba3b·general
Qwen3-30B-A3B
别名
- 首次出现
- 2026-05-22
- 最近出现
- 2026-08-28
- 累计提及
- 19
§ 01综述
§ 02相关报道10 条在档
- 01MoE模型中三种推理优化为何失效
- 02本地运行AI模型的内存知识:独立显卡与统一内存的权衡
- 03TRACE:通过信用估计实现长程智能体回合级奖励分配
- 04用大语言模型学习化学反应机理推理,Qwen3微调模型超越专用FlowER
- 05SARA:通过语义锚定路由对齐解锁MoE多语言知识
- 06结构剪枝新方法:基于归因引导和覆盖最大化的MoE压缩
- 07ConMoE:无需微调的MoE压缩框架,通过原型重分配保留专家池
- 08MoE转稠密模型:首个系统框架将混合专家模型蒸馏为全稠密架构
- 09MoE模型浪费一半专家计算?ZEDA框架让Qwen3等模型跳过简单token
- 10GoLongRL:面向长上下文的强化学习训练方案,开源数据集与TMN-Reweight方法
§ 03邻近话题