9月3日
12:05
12:05官方一手arXiv: DeepSeek@Seungwoo Jung, Dohyeok Kwon, Seungmin Cha, Junseok Lee, Yeonho Yoo, Chuck Yoo, Gyeongsik Yang
精选73°
PARSER是一种新的残差稀疏化方法,用于压缩Mixture-of-Experts大模型。该方法通过引入输出重要性指标,将压缩目标从最小化独立矩阵误差转变为保留专家输出误差。在Qwen和DeepSeek模型上,PARSER将压缩后模型与未压缩模型的精度差距分别缩小1.41倍和1.44倍,同时实现相同的峰值内存减少。
推荐理由:PARSER方法通过输出重要性指标优化MoE模型压缩,在相同内存减少下提升模型精度。
9月2日
10:18
10:18官方账号阿里通义 Qwen@Alibaba_Qwen
73°
阿里巴巴推出Qwen3.8-Max-0902模型,参数量达2.4T,上下文窗口扩展至100万token。该模型在Code & Cowork数据上进行额外训练,在复杂企业任务、科研和长流程工作流中表现更强。QwenCloud API现已上线,输入每百万token收费2美元,输出收费6美元。

推荐理由:阿里升级了Qwen3.8-Max到0902版本,参数量和上下文都大幅提升,企业级任务表现更强,价格也公布了。
09:32
09:32官方一手arXiv: DeepSeek@Seungwoo Jung, Dohyeok Kwon, Seungmin Cha, Junseok Lee, Yeonho Yoo, Chuck Yoo, Gyeongsik Yang
精选73°
PARSER是一种新的残差稀疏化方法,用于压缩Mixture-of-Experts大模型。该方法通过引入输出重要性指标,将压缩目标从最小化孤立矩阵误差转变为保留专家输出误差。实验显示,在Qwen和DeepSeek模型上,PARSER将压缩后模型与未压缩模型之间的精度差距分别缩小1.41倍和1.44倍,同时实现了相同的峰值内存减少。
推荐理由:PARSER方法解决了MoE模型压缩中误差累积问题,在相同内存减少下提升模型精度。
8月31日
23:32
8月29日
03:16
03:16官方一手marktechpost@Asif Razzaq
精选73°
Z.ai和Qwen两家中国AI实验室独立发布了几乎相同的模型架构。GLM-5.3-Flash和Qwen3.8-Flash-Next都采用了3:1线性混合架构。两家模型都使用了压缩索引器和门控残差设计。它们还都采用了Muon训练方法。
事件专题

推荐理由:两家中国实验室不约而同开发出相似架构,看看GLM和Qwen的最新flash版本有何异同。
8月27日
08:28
08:28官方账号Simon Willison’s Weblog博客/媒体
精选
Qwen 推出多模态 MoE 模型 Qwen3.8-Flash-Next,拥有 125B tokens,性能提升显著。模型在 DGX Spark 上运行,已尝试 72.5GB 和 78.9GB 版本,其中 UD-Q2_K_XL 版本表现最佳。
事件专题

推荐理由:Qwen 推出全新多模态 MoE 模型,性能卓越,值得一试。与 Qwen4 架构相似,适合探索多模态应用。
8月26日
00:04
8月25日
06:38
8月17日
10:19
10:19官方一手arXiv: DeepSeek@Shiju Zhao, Jiacheng Yang, Qihang Chen, Junhao Hu, Jiaqi Zheng, Guihai Chen, Xusheng Chen
精选
CoRun是一个面向LLM推理的调度系统,通过隔离预填充和固定形状批处理解码实现确定性输出。相比现有batch-invariant内核方案,CoRun无需牺牲性能即可保证结果一致。在Qwen和DeepSeek等模型上,CoRun吞吐量提升15%至324%,首token延迟平均降低51.8%,每token输出延迟平均降低48.6%。其核心洞察是大多数内核虽非批次不变,但具有位置不变性。
推荐理由:这篇论文说用简单填充法就能让LLM推理结果确定,不用牺牲速度,比之前的方案快了不少,还在Qwen和DeepSeek上试过。
06:39
06:39官方账号Simon Willison’s Weblog博客/媒体
精选
阿里Qwen发布Apache 2许可的Qwen 3.8 27B视觉模型,官方基准显示其超越Qwen 3.6 27B和闭源Qwen 3.7-Plus。作者在M5 Max MacBook Pro和DGX Spark上用LM Studio运行17GB Q4_K_M量化版,发现默认xhigh推理强度会消耗大量上下文。生成一张SVG用了22,276个推理token和21分钟,关闭推理后同一提示词仅需137秒。
事件专题

推荐理由:阿里新出的Qwen 3.8 27B开源模型本地可跑还带视觉,但默认爱钻牛角尖。关掉推理后同样的活从21分钟变2分钟,值得折腾。
8月16日
09:38
09:38官方账号Simon Willison’s Weblog博客/媒体
开发者用GPT-5.6-Sol构建了CORS Chat工具,用于测试LM Studio中运行的Qwen 3.8 27B模型。该工具提供Web界面,兼容OpenAI-Responses聊天端点,已在LM Studio的--cors模式和OpenRouter上验证。对话记录保存在浏览器中,可导出为JSON。它还能在流式输出时逐步渲染生成的SVG图像。
事件专题

推荐理由:西蒙威利森今天做了个叫CORS Chat的小工具,能通过网页界面测试LM Studio和OpenRouter的聊天接口,还支持流式SVG渲染,挺实用。
8月15日
12:33
12:33官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里 Qwen 团队发布 Qwen3.8-27B,定位为适合笔记本的模型,但能力达到前沿水平。该模型已上线 LM Studio,用户可直接下载体验。本地运行约需 17GB 存储空间,门槛较低。官方称其在同等尺寸模型中实现能力跃升。
事件专题

推荐理由:Qwen 出的新模型,27B 参数在笔记本上就能跑,LM Studio 里直接下,想本地玩大模型的可以试试。
02:01
02:01官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-2.4T-A95B已在DeepInfra平台上线。该稀疏MoE模型总参数达2.4万亿,激活参数为950亿,共512个专家。它面向编程、智能体工作流和复杂推理设计,原生支持262K上下文。API定价为每百万输入2美元、每百万输出6美元、缓存输入0.2美元。
推荐理由:DeepInfra上线了Qwen最新稀疏MoE模型,2.4T总参数只激活95B,专攻编程和智能体场景,价格也公布了,想试API的可以直接上手。
02:00
02:00官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Hugging Face发布2026年夏季《State of Open Models》报告。报告称,前沿模型规模越来越大,但小模型在实际使用中占主导。Qwen在本地推理使用量上领先,Gemma紧随其后。报告还显示,AI智能体已成为Hub上的重要力量。
推荐理由:Hugging Face报告显示Qwen本地推理排第一、Gemma第二,小模型玩家值得看看。
01:29
01:29官方账号Hugging Face@huggingface
HuggingFace发布2026年夏季开放模型状态报告。报告显示前沿模型规模持续扩大,但小模型仍主导实际部署。Qwen在本地推理使用量上排名第一,Gemma位居第二。AI代理已成为HuggingFace Hub上的重要增长动力。
推荐理由:HuggingFace出了份开放模型夏季报告,告诉你哪些小模型最常用,Qwen和Gemma谁跑得靠前,搞本地部署前先看看。
8月13日
8月12日
16:06
16:06官方一手pandaily@contact@pandaily.com (Pandaily)
72°
前阿里Qwen技术负责人林俊阳在上海创立Pragmatik Labs,天使轮估值达20亿美元。高榕和红杉中国各领投1亿美元,腾讯追加2000万美元。公司定位数字与物理智能体,而非基础模型。林俊阳曾是阿里最年轻的P10级工程师之一。

推荐理由:前Qwen技术负责人创业,估值20亿美元,高榕红杉腾讯都投了。不做大模型改做智能体,方向值得关注。
8月10日
13:40
13:40官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Qwen-MM-Plugins 是阿里 Qwen 团队发布的插件套件,能让现有智能体框架原生支持多模态输入。它可读取图片、视频与文档,还支持视频编辑和 3D/CAD 文件处理。官方演示展示了从多模态模型到多模态智能体的能力扩展。
推荐理由:Qwen出了个插件包,让你的agent能看图、读视频、改视频、处理3D模型,直接把多模态能力塞进现有框架。
8月7日
16:49
16:49官方一手pandaily@contact@pandaily.com (Pandaily)
阿里旗下Qwen App本周推出重大更新,首次在纯免费聊天机器人基础上增加付费内容。新版捆绑了办公助手、定时任务和旗舰模型Qwen3.8-MAX的访问权限。这明确传递信号:生产力场景将逐步移入付费墙。目前该功能处于测试阶段,具体定价尚未公布。

推荐理由:阿里把Qwen App的办公助手和Qwen3.8-MAX丢进付费测试了,想跟豆包抢办公场景,你可以先看看免费版还剩啥。