9月2日
14:48
14:48IT之家博客/媒体
73°
Arena平台发布2026年第35周AI大模型盲测排行榜。国产GLM-5.3-Flash首次进入代码榜Top 10,ELO分数达1535分。Qwen3.8-Max-0902首次入榜即登顶前端开发榜榜首,ELO分数未公布。Kimi-K3-Max稳定守住综合榜Top 10位置,ELO分数为1489分。
事件专题

推荐理由:国产模型在细分领域表现亮眼,GLM-5.3-Flash代码能力超越多数海外模型,千问3.8-Max直接登顶前端榜。
9月1日
13:13
8月26日
00:40
00:40elvis@omarsar0
精选
Alibaba introduces a new approach to long-running agents, treating context management as a programming task. It uses an append-only event log and a persistent Python kernel, achieving high scores in LongMemEval_S, BEAM_10M, and LOCA_256K. Paper available at arxiv.org/abs/2608.21690.

推荐理由:Check out Alibaba's innovative approach to agent context management, outperforming existing systems with Qwen3.8-Max. It's a game-changer for long-running agents!
8月20日
23:05
23:05IT之家博客/媒体
阿里巴巴发布2027财年第一财季报告,营业总收入2689.53亿元,同比增长9%。归母净利润105.37亿元,同比下降76%。AI云与算力服务收入达到484.37亿元,同比增长45%。公司发布新一代旗舰基础模型Qwen3.8-Max,拥有2.4万亿总参数并开放权重。
推荐理由:阿里巴巴发了财报,AI业务收入涨了45%,还发布了新模型Qwen3.8-Max,虽然净利润降了76%,但AI这块增长挺猛的。
8月15日
00:28
00:28官方账号阿里通义 Qwen@Alibaba_Qwen
78°
阿里Qwen团队发布Qwen3.8-Max,总参数2.4T、激活参数95B、上下文窗口1M。该模型为开源权重MoE,编码与智能体能力突出。Together AI作为Day 0发布伙伴,已同步上线推理服务。开发者现可直接在Together AI平台调用该模型。

推荐理由:Qwen3.8-Max刚发布就上了Together AI,2.4T参数的开源MoE,当天就能用,编码和智能体能力都挺强。
00:25
00:25官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里云发布 Qwen3.8-Max,即 2.4T-A95B 架构。即日起可通过 DigitalOcean Serverless Inference 调用,运行在 NVIDIA HGX B300 GPU 上。模型支持 1M token 上下文,专为长时程编码任务设计。用户按 API 用量付费,无需自建基础设施。
事件专题

推荐理由:阿里云把Qwen3.8-Max放上DigitalOcean了,1M上下文,写长代码直接调,按量付费不用管服务器。
8月12日
17:33
17:33官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Qwen3.8-Max在Legal Research Bench上的得分在不到三个月内几乎翻倍,排名从第22位跃升至第4位。Vals AI在推文中强调了这一进步,并附上了相关链接。该模型在基准测试中的显著提升展示了其在法律研究领域的性能增强。
推荐理由:Qwen3.8-Max在Legal Research Bench上从第22冲到第4,三个月内得分翻倍,看看它怎么做到的。
8月6日
19:13
19:13官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Qwen3.8-Max在Artificial Analysis Intelligence Index上排名第五,并在Agentic Index上位列第一。该模型由阿里通义千问团队发布,当前基准成绩显示了其在智能体任务上的领先表现。团队表示将继续推进模型迭代。

推荐理由:阿里刚发的Qwen3.8-Max,智能体能力跑到第一了,总榜第五,想追新模型可以看看。
8月5日
11:27
11:27官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-Max在Image-to-WebDev Arena中以1,631分位列第二。这个基准测试考察模型将截图转化为网页代码的能力。目前榜首是Claude Opus 5 (Max),领先Qwen3.8-Max 39分。阿里巴巴官方账号发布了这一排名消息。
事件专题

推荐理由:阿里新出的Qwen3.8-Max看图写网页排第二,只比第一的Claude Opus 5少39分,挺牛的。
01:29
01:29官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里通义千问发布的最新模型 Qwen3.8-Max 已集成到 Nous Research 的 Hermes Agent 中。用户执行 hermes update 即可使用,并可享受 20% 折扣。该模型面向智能体开发场景,可直接在 Agent 工作流中调用。
推荐理由:Qwen3.8-Max 现在在 Hermes Agent 里能用了,还打八折,一条命令就能上手,赶紧试试。
8月4日
01:43
8月3日
19:21
19:21官方账号Decoder@Jonathan Kemper
74°
阿里巴巴发布旗舰模型Qwen3.8-Max,总参数达2.4万亿。该模型可自主执行跨数天的复杂任务,包括复现研究论文和设计芯片。与常见闭源模型不同,Qwen3.8-Max采用开放权重,团队计划下周公布权重文件。

推荐理由:阿里那个2.4万亿参数的Qwen3.8-Max要开源了,能自己搞芯片设计,下周放权重,想玩长任务的盯紧点。
16:39
16:13
16:00
16:00官方一手pandaily@contact@pandaily.com (Pandaily)
79°
阿里巴巴发布Qwen3.8-Max正式版,参数量达2.4万亿。该模型支持1M上下文窗口,可执行长时间运行的智能体任务。官方称其编码与办公能力显著提升,跻身全球第一梯队。开源权重预计一周内公布,开发者可下载使用。

推荐理由:阿里发了Qwen3.8-Max,2.4T参数加1M上下文,做长任务Agent很强,而且下周就开源了,能直接玩。
15:14
14:39
12:24
11:11
10:35
10:35IT之家博客/媒体
阿里巴巴今日发布千问 Qwen3.8-Max,参数规模达 2.4 万亿。官方称其在编程、真实办公、长程任务与多模态智能体方面实现提升。该模型能以极少人工介入端到端完成复杂开放目标。模型权重将于下周开源。

推荐理由:千问新模型 Qwen3.8-Max 有 2.4 万亿参数,编程办公更强,端到端自主干活,下周还开源。
7月20日