8月27日
01:43
01:43Jerry Liu@jerryjliu0
精选
ExtractBench测试20多个模型在文档提取任务上的表现,Qwen 3.8模型表现最佳,GLM-5.3-flash和qwen 3.8 flash新版本也刚刚发布。测试结果基于统一F1的“价值准确性”指标,不包含视觉定位和置信度评分。
事件专题

推荐理由:ExtractBench最新测试了20多个模型,Qwen 3.8模型表现抢眼,新版本GLM-5.3-flash和qwen 3.8 flash也值得关注。
8月15日
01:31
01:31官方账号Decoder@Matthias Bastian
阿里Qwen团队发布Qwen 3.8,权重以Apache 2.0许可开放。该模型是270亿参数的密集模型,原生上下文长度达262000个token。官方称其在编码和办公任务上优于尺寸更大的Qwen 3.7 Plus。这一版本面向构建本地应用和智能体应用的开发者。

推荐理由:阿里开源了Qwen 3.8,270亿参数比Qwen 3.7 Plus更强,原生支持26.2万token上下文,做本地和智能体应用可以看看。
7月22日
22:19
22:19官方账号Nathan Lambert: Interconnects@Nathan Lambert
文章回顾了近期开源模型进展,重点讨论了Kimi K3和Qwen 3.8的发布。提及中国WAIC上习近平的演讲对开放AI生态的影响。分析了AI蒸馏技术对模型能力的提升和开源与闭源模型之间差距的缩小。最后展望了开源模型下一步的发展方向。
事件专题

推荐理由:聊了Kimi K3、Qwen 3.8这些新进展,还有WAIC上习近平的发言,分析了蒸馏和开闭源差距,看完对开源格局心里有数。
09:50
7月19日
21:27
21:27shao__meng@shao__meng
DeepSeek V4 和 GLM 5.2 已发布。本周 Kimi K3 和 Qwen 3.8 曝光,对标 Claude Fable 5 和 GPT-5.6 Sol。Tencent Hy3 提升很大,MiniMax M3 落后但后续期待。Gemini 3.5 Pro 原定7月17日发布,因内部评估未通过而推迟。
事件专题

推荐理由:这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
20:15