8月15日
03:06
03:06ollama@ollama
阿里 Qwen 团队与 Ollama 达成合作,Qwen3.8-27B 模型已上架 Ollama 平台。用户可直接通过 Ollama 运行该模型。据官方说法,Qwen3.8-27B 在各种 harness 下都能稳定输出。开发者可通过 Ollama 调用该模型进行编程等任务。
事件专题

推荐理由:Qwen 最新模型 Qwen3.8-27B 上架 Ollama 了,想本地跑模型的直接开整,官方说怎么测都稳,去试试。
02:57
02:02
02:02官方账号阿里通义 Qwen@Alibaba_Qwen
阿里通义千问推出 Qwen3.8-27B 密集模型,定位本地 AI 开发。AMD 提供首日支持,可在 Ryzen AI Max+ 处理器或单张 Radeon AI PRO R9700 显卡上运行。开发者可通过 LM Studio 直接体验,并用 lemonade_server 将模型封装成应用。
事件专题

推荐理由:AMD 用户能第一时间在自家电脑上跑 27B 模型,用 LM Studio 就能玩,还能快速做成应用。
02:00
02:00官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Hugging Face发布2026年夏季《State of Open Models》报告。报告称,前沿模型规模越来越大,但小模型在实际使用中占主导。Qwen在本地推理使用量上领先,Gemma紧随其后。报告还显示,AI智能体已成为Hub上的重要力量。
推荐理由:Hugging Face报告显示Qwen本地推理排第一、Gemma第二,小模型玩家值得看看。
02:00
02:00官方账号阿里通义 Qwen@Alibaba_Qwen
78°
阿里开源了 Qwen3.8-2.4T-A95B,总参数 2.4T,每次推理激活 95B 参数。SiliconFlow 在发布当天即提供该模型的 API 服务。定价为输入每百万 token 2 美元、输出 6 美元、缓存输入 0.25 美元。该模型面向自主编程、深度研究和端到端智能体执行场景。
推荐理由:阿里 Qwen3.8 开源当天就能在 SiliconFlow 上直接调用,2.4T 参数输入才两美元每百万 token,写代码做研究都能一口气跑完。
01:31
01:31官方账号Decoder@Matthias Bastian
阿里Qwen团队发布Qwen 3.8,权重以Apache 2.0许可开放。该模型是270亿参数的密集模型,原生上下文长度达262000个token。官方称其在编码和办公任务上优于尺寸更大的Qwen 3.7 Plus。这一版本面向构建本地应用和智能体应用的开发者。

推荐理由:阿里开源了Qwen 3.8,270亿参数比Qwen 3.7 Plus更强,原生支持26.2万token上下文,做本地和智能体应用可以看看。
01:30
01:30官方一手歸藏(guizang.ai)@op7418
75°
智谱为 GLM-5.3 开源发布撰文,主张网络防御能力不应只属于少数大型机构。文中强调开源维护者、独立开发者和小型团队也需要这些工具,GLM-5.3 则大幅强化了网络安全任务能力。该发布由 Z.ai 推进。
事件专题

推荐理由:智谱马上要开源 GLM-5.3,这次重点补强网络安全任务,还专门说防御能力不该被大机构垄断,中小团队和独立开发者也能用上。
00:28
00:28官方账号阿里通义 Qwen@Alibaba_Qwen
78°
阿里Qwen团队发布Qwen3.8-Max,总参数2.4T、激活参数95B、上下文窗口1M。该模型为开源权重MoE,编码与智能体能力突出。Together AI作为Day 0发布伙伴,已同步上线推理服务。开发者现可直接在Together AI平台调用该模型。

推荐理由:Qwen3.8-Max刚发布就上了Together AI,2.4T参数的开源MoE,当天就能用,编码和智能体能力都挺强。
00:26
00:26官方账号阿里通义 Qwen@Alibaba_Qwen
76°
阿里开源Qwen3.8-27B,SGLang团队当天完成适配。在单张RTX 5090上,借助NVFP4和DSpark优化,解码速度达到206.1 tok/s。在DGX Spark上解码速度为38.28 tok/s。该模型在智能体规划和长时任务上表现突出。
事件专题

推荐理由:Qwen3.8-27B开源了,SGLang当天就能跑,单张5090能到206 tok/s,小模型之王回来了,试试吧。
00:14
00:14elvis@omarsar0
GLM-5.3 由 Z.ai 发布,基于 743B 基础模型进行后训练强化。该模型在编程和智能体任务上表现突出,据称达到开源模型第一梯队。Z.ai 称其在网络安全领域树立了开源模型新标准。模型权重开放,开发者可自行部署测试。
事件专题

推荐理由:Z.ai 放出了开源模型 GLM-5.3,743B 大底子,编程和智能体能力很强,还主打网络安全,开源党可以试试。
8月14日
18:47
18:47官方账号Decoder@Matthias Bastian
72°
智谱AI发布GLM-5.3,并称其为最强的开源权重编码模型。据其自家基准,仅通过后训练就比上一代提升50%。该模型经过网络安全训练,帮助安全团队在269个项目中找到2436个漏洞。模型权重计划在两周后开源。
事件专题

推荐理由:智谱发了GLM-5.3,说是开源编码模型里最强的,后训练提升50%,还帮找出了2436个漏洞,权重两周后开源,可以关注下。
18:12
15:14
15:14Geek@geekbb
Z.ai发布开源模型GLM-5.3,基于743B基础模型进行后训练。官方称其编码与智能体能力达到顶级水平,并在网络安全领域为开源模型树立新标准。社区讨论中,有网友希望其定价能压低Grok 4.6和DeepSeek V4 Pro。
事件专题

推荐理由:GLM-5.3开源发布了,743B后训练,主打编码和网络安全。蹲个价格,看它能不能背刺Grok和DeepSeek。
15:09
14:56
14:56ollama@ollama
Z.ai 发布开源模型 GLM-5.3,通过 743B 基础模型后训练实现顶级编码与智能体能力。该模型在网络安全领域设立新标准,成为开放模型的新标杆。Ollama 宣布将在其正式开放发布时提供支持,技术博客已公开细节。
事件专题

推荐理由:GLM-5.3 来了,743B 底座,编码和网络防御能力很强,Ollama 也已宣布支持,想试的可以直接上手。
12:05
12:05官方账号arXiv cs.AI@Peter Schneider-Kamp, Jacob Nielsen, Gianluca Barmina, Kenneth Enevoldsen, Lukas Galke Poech
DFM Mimir v1是丹麦基础模型团队发布的10亿参数语言模型,基于HRM架构从零训练。该模型仅使用许可的后训练数据,混合了161个数据集进行训练。在20个英语、数学与代码及丹麦语基准上,Mimir v1超过HRM-Text 1B,并可与Qwen 3.5 4B和Gemma 4 E2B竞争。它在丹麦语任务上刷新了最先进水平,模型现已在Hugging Face Hub开放下载。
事件专题

推荐理由:丹麦团队开源了10亿参数的Mimir v1,只用合规数据就追上4B模型,丹麦语还是第一。
05:42
05:42Hailuo AI@Hailuo_AI
精选76°
MiniMax 正式发布新一代开源权重音乐模型 MiniMax-Music3。该模型定位生产级(production-ready),可用于多种音乐生成场景。官方称其为 SOTA 级开源音乐模型。权重开放,开发者可自行部署和微调。
推荐理由:MiniMax 把音乐模型开源了,叫 Music3,号称开源里最强,能直接生成各种风格的音乐,适合想做 AI 音乐应用的人。
05:19
05:19techcrunch@Russell Brandom
Writer 发布了基于 Z.ai 开源模型 GLM-5.2 的后训练新模型。新系统(基于 GLM-5.2)宣称以更低价格提供部署就绪能力,并升级 harness 控制 token 成本。Writer 表示,该模型延续了 GLM-5.2 的开源生态优势。
推荐理由:Writer 出了新模型,基于 GLM-5.2 改的,价格更低还升级工具省 token 成本,适合想省钱的开发者。
8月13日
18:14
18:14官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA Nemotron 3.5 Lightning 已在 Baseten 上线,定位为长时运行智能体设计。相比同类开源模型,其吞吐量提升 4 倍,成本降低 50%。在生产测试中,输出 token 数量减少 63.4%。该模型采用 30B MoE 架构,仅激活 3B 参数,支持 100 万 token 上下文。
事件专题

推荐理由:跑长时任务的智能体注意了,Nemotron 3.5 Lightning 上线 Baseten,吞吐翻 4 倍、成本砍半,输出还更精简。