08:28官方账号Simon Willison’s Weblog(博客/媒体)精选Qwen 推出多模态 MoE 模型 Qwen3.8-Flash-Next,拥有 125B tokens,性能提升显著。模型在 DGX Spark 上运行,已尝试 72.5GB 和 78.9GB 版本,其中 UD-Q2_K_XL 版本表现最佳。AI模型Qwen多模态MoE 模型1 个信源在谈事件专题推荐理由:Qwen 推出全新多模态 MoE 模型,性能卓越,值得一试。与 Qwen4 架构相似,适合探索多模态应用。原文稍后读已读值得跟进有用关注 Qwen
20:44IT之家(博客/媒体)72°阿里通义千问团队发布 Qwen3.8-Flash,125B 参数 MoE 模型,训练成本降为前代 1/9,性能更强。支持 1M 上下文,已开源。AI模型阿里通义Qwen3.8-FlashMoE 模型推荐理由:阿里通义新模型 Qwen3.8-Flash 开源,参数量大幅提升,训练成本降低,值得开发者关注。原文稍后读已读值得跟进有用关注 阿里通义