15:43量子位@量子位的朋友们73°阿里发布Qwen3.8-Max模型,在HumanEval编程基准上得分为84.5分,超越GPT-4o成为全球第一。该模型在代码生成、调试和优化方面表现优异,支持多种编程语言。Qwen3.8-Max还增强了多模态处理能力,能够理解和生成图文内容。AI模型Qwen3.8-Max阿里编程推荐理由:阿里Qwen3.8-Max编程能力登顶全球,代码生成超越GPT-4o,开发者必看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
14:48IT之家(博客/媒体)阿里云今日推出企业级人与 Agent 协作平台“万有无界”,已开启公测。该平台支持调用阿里最新旗舰模型 Qwen3.8-Max,采用多角色 Agent 协作模式。平台设有“小万”和“小有”两个主 Agent,分别担任个人助理和项目经理角色。万有无界强调组织记忆与流程资产全部归属企业账户,确保组织能力连续性。AI产品万有无界阿里云Qwen3.8-Max推荐理由:阿里云推出的万有无界平台,让多个 Agent 协作完成任务,企业可沉淀数字资产,比传统 AI 工具更适合团队协作。原文稍后读已读值得跟进有用关注 万有无界
14:48IT之家(博客/媒体)73°Arena平台发布2026年第35周AI大模型盲测排行榜。国产GLM-5.3-Flash首次进入代码榜Top 10,ELO分数达1535分。Qwen3.8-Max-0902首次入榜即登顶前端开发榜榜首,ELO分数未公布。Kimi-K3-Max稳定守住综合榜Top 10位置,ELO分数为1489分。AI模型GLM-5.3-FlashQwen3.8-MaxKimi-K3-Max2 个信源在谈事件专题推荐理由:国产模型在细分领域表现亮眼,GLM-5.3-Flash代码能力超越多数海外模型,千问3.8-Max直接登顶前端榜。原文稍后读已读值得跟进有用关注 GLM-5.3-Flash
11:16IT之家(博客/媒体)73°阿里千问宣布Qwen3.8-Max升级到0902版本,在CodeArena前端编程总榜中以1691分夺得冠军,提升22分。该模型在多步推理、工具调用和端到端app生成方面刷新全球模型上限。Qwen3.8-Max-0902每百万Tokens综合平均价格为5美元,性价比显著高于排名第二和第三的模型。AI模型Qwen3.8-Max阿里千问CodeArena推荐理由:阿里千问Qwen3.8-Max-0902版本上线,前端编程能力全球第一,价格仅竞品1/4原文稍后读已读值得跟进有用关注 Qwen3.8-Max
13:13官方账号阿里通义 Qwen@Alibaba_Qwen73°CommerceAgentBench基准测试专注于真实商业需求,而非仅测试模型回答能力。该基准测试显示最佳整体完成率约为62%。Qwen3.8-Max在评估的开源权重模型中表现最强,能够处理复杂商业工作流。该基准已开源,可在GitHub查看完整结果。AI模型CommerceAgentBenchQwen3.8-Max商业代理推荐理由:阿里发布商业代理基准测试,Qwen3.8-Max在复杂商业工作流中表现最佳,完成率达62%。原文稍后读已读值得跟进有用关注 CommerceAgentBench
00:40elvis@omarsar0精选Alibaba introduces a new approach to long-running agents, treating context management as a programming task. It uses an append-only event log and a persistent Python kernel, achieving high scores in LongMemEval_S, BEAM_10M, and LOCA_256K. Paper available at arxiv.org/abs/2608.21690.论文Alibabacontext managementQwen3.8-Max推荐理由:Check out Alibaba's innovative approach to agent context management, outperforming existing systems with Qwen3.8-Max. It's a game-changer for long-running agents!原文稍后读已读值得跟进有用关注 Alibaba
23:05IT之家(博客/媒体)阿里巴巴发布2027财年第一财季报告,营业总收入2689.53亿元,同比增长9%。归母净利润105.37亿元,同比下降76%。AI云与算力服务收入达到484.37亿元,同比增长45%。公司发布新一代旗舰基础模型Qwen3.8-Max,拥有2.4万亿总参数并开放权重。行业阿里巴巴Qwen3.8-MaxAI云推荐理由:阿里巴巴发了财报,AI业务收入涨了45%,还发布了新模型Qwen3.8-Max,虽然净利润降了76%,但AI这块增长挺猛的。原文稍后读已读值得跟进有用关注 阿里巴巴
00:28官方账号阿里通义 Qwen@Alibaba_Qwen78°阿里Qwen团队发布Qwen3.8-Max,总参数2.4T、激活参数95B、上下文窗口1M。该模型为开源权重MoE,编码与智能体能力突出。Together AI作为Day 0发布伙伴,已同步上线推理服务。开发者现可直接在Together AI平台调用该模型。AI模型Qwen3.8-MaxTogether AI开源模型推荐理由:Qwen3.8-Max刚发布就上了Together AI,2.4T参数的开源MoE,当天就能用,编码和智能体能力都挺强。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
00:27官方账号阿里通义 Qwen@Alibaba_Qwen阿里通义千问的Qwen3.8-Max(即Qwen3.8-2.4T-A95B)在Fireworks平台首发上线,获得Day 0支持。这款模型采用MoE架构,总参数达2.4T,激活参数95B,专为自主智能体、重度编码和超长上下文场景设计。开发者现可通过Fireworks直接调用,用于构建agent工作流和代码生成任务。AI模型Qwen3.8-MaxFireworks智能体推荐理由:阿里把2.4T参数的MoE模型Qwen3.8-Max放到了Fireworks上,今天就能用,专门干智能体和写代码的活儿。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
00:25官方账号阿里通义 Qwen@Alibaba_Qwen精选阿里云发布 Qwen3.8-Max,即 2.4T-A95B 架构。即日起可通过 DigitalOcean Serverless Inference 调用,运行在 NVIDIA HGX B300 GPU 上。模型支持 1M token 上下文,专为长时程编码任务设计。用户按 API 用量付费,无需自建基础设施。AI模型Qwen3.8-MaxDigitalOcean阿里云3 个信源在谈事件专题推荐理由:阿里云把Qwen3.8-Max放上DigitalOcean了,1M上下文,写长代码直接调,按量付费不用管服务器。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
17:33官方账号阿里通义 Qwen@Alibaba_Qwen精选Qwen3.8-Max在Legal Research Bench上的得分在不到三个月内几乎翻倍,排名从第22位跃升至第4位。Vals AI在推文中强调了这一进步,并附上了相关链接。该模型在基准测试中的显著提升展示了其在法律研究领域的性能增强。AI模型Qwen3.8-MaxLegal Research BenchVals AI推荐理由:Qwen3.8-Max在Legal Research Bench上从第22冲到第4,三个月内得分翻倍,看看它怎么做到的。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
19:46官方账号阿里通义 Qwen@Alibaba_Qwen用户 Ann Nguyen 给 Qwen3.8-Max 发了一张天空照片,让它根据云朵形状画出动物剪影,并用 Claude Opus 5、Kimi K3、GPT 5.6 Sol 做了同样测试。她评价 Qwen3.8-Max 的表现与 Claude Opus 5、Kimi K3、GPT 5.6 Sol 不相上下。这个测试展示了 Qwen3.8-Max 的视觉联想和绘图能力。AI模型Qwen3.8-MaxClaude Opus 5Kimi K310 个信源在谈事件专题推荐理由:有人拿云朵照片同时问 Qwen3.8-Max、Claude Opus 5、Kimi K3、GPT 5.6 Sol,画动物轮廓它没输。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
18:10官方账号阿里通义 Qwen@Alibaba_Qwen阿里通义团队发布新一代模型 Qwen3.8-Max。第三方开发者 SkalskiP 的测试显示,Qwen3.8-Max 比 Gemini 3.5 Flash 高出 8.5 个百分点。官方推文感谢这次测试,称 Qwen3.8-Max 能让人更细致地观察世界。测试细节和基准名称尚未完整公开。AI模型Qwen3.8-MaxGemini 3.5 FlashAlibaba推荐理由:Qwen3.8-Max 刚出,有人测了比 Gemini 3.5 Flash 高 8.5 个点,看细节更清楚。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
19:13官方账号阿里通义 Qwen@Alibaba_Qwen精选Qwen3.8-Max在Artificial Analysis Intelligence Index上排名第五,并在Agentic Index上位列第一。该模型由阿里通义千问团队发布,当前基准成绩显示了其在智能体任务上的领先表现。团队表示将继续推进模型迭代。AI模型Qwen3.8-Max通义千问智能体推荐理由:阿里刚发的Qwen3.8-Max,智能体能力跑到第一了,总榜第五,想追新模型可以看看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
12:24Geek@geekbb75°VulcanBench 用 23 个真实软件工程任务评测模型,Qwen3.8-Max 跑完全套成本 126.25 美元,DeepSeek V4-Flash 仅需 13.60 美元。Qwen3.8-Max 每个任务耗时 20-25 分钟,是测试中最慢的模型,固定预算下最佳设置只排中游,默认设置垫底。六个原本能解决的任务贡献了 26 分降幅的 83%,其中三个得分直接归零。在准确率上 Grok 4.5 领先,按每美元准确率 DeepSeek V4-Flash 很难被击败。AI模型VulcanBenchQwen3.8-MaxDeepSeek V4-Flash7 个信源在谈事件专题推荐理由:VulcanBench 实测:Qwen3.8-Max 跑一趟 126 美元,DeepSeek V4-Flash 只要 13.6 美元,便宜 10 倍还更快。选性价比就 DeepSeek,选准确率就 Grok 4.5。原文稍后读已读值得跟进有用关注 VulcanBench
11:27官方账号阿里通义 Qwen@Alibaba_QwenQwen3.8-Max在Image-to-WebDev Arena中以1,631分位列第二。这个基准测试考察模型将截图转化为网页代码的能力。目前榜首是Claude Opus 5 (Max),领先Qwen3.8-Max 39分。阿里巴巴官方账号发布了这一排名消息。AI模型Qwen3.8-MaxImage-to-WebDev ArenaClaude Opus 51 个信源在谈事件专题推荐理由:阿里新出的Qwen3.8-Max看图写网页排第二,只比第一的Claude Opus 5少39分,挺牛的。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
09:44lmarena.ai@lmarena_ai82°Qwen3.8-Max在Image-to-WebDev Arena以1631分排名第二,仅落后Claude Opus 5(Max)39分。该模型拥有2.4T参数,支持10天以上自主编码开发,可完成500+轮芯片设计优化。官方宣布下周开源Qwen3.8-Max和Qwen3.8-27B权重。API定价为输入每百万token 2美元、输出6美元。AI模型Qwen3.8-MaxAlibabaQwen1 个信源在谈事件专题推荐理由:阿里这波可以啊,Qwen3.8-Max网页开发跑分第二,只比Claude Opus 5低39分,下周开源就能玩。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
01:29官方账号阿里通义 Qwen@Alibaba_Qwen精选阿里通义千问发布的最新模型 Qwen3.8-Max 已集成到 Nous Research 的 Hermes Agent 中。用户执行 hermes update 即可使用,并可享受 20% 折扣。该模型面向智能体开发场景,可直接在 Agent 工作流中调用。AI模型Qwen3.8-MaxHermes AgentNous Research推荐理由:Qwen3.8-Max 现在在 Hermes Agent 里能用了,还打八折,一条命令就能上手,赶紧试试。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
01:43elvis@omarsar0阿里巴巴发布Qwen3.8-Max,主打编码与协作场景。开发者在Hermes Agent上实测后表示,开源前沿模型已经追上闭源模型。该模型被视为开源界在编码方向上的新标杆。AI模型Qwen3.8-MaxHermes Agent阿里巴巴推荐理由:阿里Qwen3.8-Max在Hermes Agent上表现很猛,编码和协作都强,开源都快追上闭源了,你可以试试。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
19:21官方账号Decoder@Jonathan Kemper74°阿里巴巴发布旗舰模型Qwen3.8-Max,总参数达2.4万亿。该模型可自主执行跨数天的复杂任务,包括复现研究论文和设计芯片。与常见闭源模型不同,Qwen3.8-Max采用开放权重,团队计划下周公布权重文件。AI模型Qwen3.8-MaxAlibaba智能体推荐理由:阿里那个2.4万亿参数的Qwen3.8-Max要开源了,能自己搞芯片设计,下周放权重,想玩长任务的盯紧点。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
16:39官方一手marktechpost@Asif Razzaq76°阿里Qwen团队将Qwen3.8-Max从预览转为正式可用,并公布了按token计费的价格。该模型为2.4万亿参数的MoE架构,支持文本、图像和视频输入,上下文窗口为100万token。官方尚未公布基准测试结果,开放权重预计下周发布。AI模型Qwen3.8-MaxAlibaba多模态推荐理由:Qwen3.8-Max正式上线,2.4T参数MoE,能看视频,上下文100万token,权重下周开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
16:35官方账号阿里通义 Qwen@Alibaba_Qwen精选Qwen3.8-Max 在 Arena.ai 的 Frontend Code Arena 排行榜上拿下 1668 分,位列第四。它落后于 Claude Opus 5 (Max) 的 1705 分和 Kimi K3 (Max) 的 1676 分,与 Claude Opus 5 (High) 的 1669 分几乎持平。细分领域中,Consumer Product 排第二,Brand & Marketing、Reference-based design、Gaming、Content Creation Tools 均排第三。Data & Analytics 排第四,Simulations 排第五。阿里 Qwen 官方称该模型在 Text Arena 的真实任务中也有表现。AI模型Qwen3.8-MaxAlibaba_QwenArena.ai推荐理由:Qwen 的 Qwen3.8-Max 冲到代码榜第四,只比 Claude Opus 5 High 档低一分,做前端的可以看看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
16:13官方一手歸藏(guizang.ai)@op741872°阿里云发布Qwen3.8-Max。这款3.8版本属于千问系列,并强调'重置'。目前官方未给出Qwen3.8-Max的基准测试分数。AI模型Qwen3.8-Max阿里云千问1 个信源在谈事件专题推荐理由:阿里云正式发了Qwen3.8-Max,说是'重置'了一波,想知道千问新版本有啥变化可以去看看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
16:00官方一手pandaily@contact@pandaily.com (Pandaily)79°阿里巴巴发布Qwen3.8-Max正式版,参数量达2.4万亿。该模型支持1M上下文窗口,可执行长时间运行的智能体任务。官方称其编码与办公能力显著提升,跻身全球第一梯队。开源权重预计一周内公布,开发者可下载使用。AI模型Qwen3.8-MaxAlibaba智能体推荐理由:阿里发了Qwen3.8-Max,2.4T参数加1M上下文,做长任务Agent很强,而且下周就开源了,能直接玩。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
15:14量子位@梦瑶阿里发布Qwen3.8-Max。Qwen3.8-Max在编程、专业工作、长程任务、多模态分析等场景表现突出。其综合能力进入全球第一梯队,与Claude表现相近。AI模型Qwen3.8-MaxClaude阿里推荐理由:阿里发了Qwen3.8-Max,编程和多模态都强,据说能跟Claude掰手腕,想升级的可以关注。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
14:39量子位@量子位的朋友们阿里巴巴正式发布新一代基座大模型Qwen3.8,官方称整体性能处于全球大模型第一梯队。该模型在编程与办公场景下推理更快更稳定。Qwen3.8-Max预计下周开源,同时还将开源Qwen3.8-27B。AI模型Qwen3.8阿里巴巴Qwen3.8-Max推荐理由:阿里发了Qwen3.8,性能进第一梯队,Max版下周开源,想试新模型的可以蹲一下。原文稍后读已读值得跟进有用关注 Qwen3.8
14:08shao__meng@shao__meng81°阿里发布 Qwen3.8-Max,参数规模 2.4T,主打自主编码和长时任务。官方称它能在无人干预下完成 10 天以上的开发流程,并跑过 500 多轮芯片设计优化。定价为输入 2 美元/百万 tokens,输出 6 美元/百万 tokens,缓存 0.25 美元/百万 tokens。下周 Qwen3.8-Max 和 Qwen3.8-27B 的权重将一同开源。AI模型Qwen3.8-MaxQwen3.8-27B开源模型1 个信源在谈事件专题推荐理由:阿里把 2.4T 参数的 Qwen3.8-Max 拿出来,下周连 27B 一起开源,缓存价只要 0.25 美元,可以蹲一手。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
13:33官方账号阿里通义 Qwen@Alibaba_Qwen78°阿里通义发布Qwen3.8-Max,参数规模2.4T,输入定价每百万tokens 2美元、输出6美元。官方称其可实现10天以上自主编码,从空文件夹到生产环境无需人工干预。该模型支持500+轮芯片设计优化与365天电商策略规划,视觉作为持续反馈参与规划与修正。Qwen3.8-27B也将开源,开放权重于下周放出。AI模型Qwen3.8-MaxQwen3.8-27BAlibaba1 个信源在谈事件专题推荐理由:阿里发了Qwen3.8-Max,2.4T参数,能自己写代码跑10天出成品,下周开放权重,27B版也一起开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
12:36小互@imxiaohu72°Qwen3.8-Max 总参数量 2.4T、激活参数 95B,官方宣布下周开源,是 Qwen Max 系列首次开源。它在 oh-my-cli 项目中自主运行 16 天完成无人编程,并在电商多模态意图识别竞赛中提交 45 次,准确率从 0.60 提升到 0.853,击败 458 支队伍。在 365 天模拟电商经营中,模型实现 4.16 倍资金回报,净赚超 10 万元。它还花 125 小时写 7,600 行代码复现论文,并在 AIME24 上反超原论文 2.71 分。视觉与多模态方面,模型支持分析 100+ 小时长视频,并能通过 Hybrid Agent 编程与 GUI 操作复刻应用。AI模型Qwen3.8-Max开源模型智能体推荐理由:Qwen Max 首次开源,2.4T 参数下周见;它能自己跑 16 天干活,还拿过 4.16 倍回报。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
12:24官方一手歸藏(guizang.ai)@op741881°Qwen3.8-Max是阿里通义千问最新旗舰模型,参数规模达2.4T。输入每百万token定价2美元,输出6美元,缓存0.25美元。官方称其可自主完成10天以上的编码开发,并支持500多轮芯片设计优化和365天电商策略。开放权重的版本将于下周发布,同时Qwen3.8-27B也将开源。AI模型Qwen3.8-MaxAlibaba开源模型推荐理由:阿里发了Qwen3.8-Max,2.4T参数,能自己写代码跑10天,下周开源权重,还有便宜缓存,想试大模型可以看看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
12:17lmarena.ai@lmarena_ai精选Qwen3.8-Max在Frontend Code Arena拿到1668分,位列第四,排在GLM-5.2和DeepSeek-V4-Flash之前。它落后Claude Opus 5(Max)的1705分和Kimi K3(Max)的1676分,与Claude Opus 5(High)的1669分持平。该模型的定价是每百万输入token 2美元、输出token 6美元,重塑了前端代码生成的性价比帕累托前沿。它在消费产品类排名第二,在品牌营销、参考设计、游戏和内容创作工具类均排第三。AI模型Qwen3.8-Max阿里巴巴前端代码生成9 个信源在谈事件专题推荐理由:阿里新模型Qwen3.8-Max代码榜排第四,1668分,输入输出token价格只要2美元和6美元,性价比很能打。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
11:13lmarena.ai@lmarena_ai精选Qwen3.8-Max在Frontend Code Arena以1668分位列第四,仅次于Claude Opus 5 (Max)的1705分和Kimi K3 (Max)的1676分。该模型参数达2.4T,支持自主编码、多模态感知和长程规划,官方称可完成500+轮芯片设计优化。API定价为输入2.0美元/百万tokens,输出6.0美元/百万tokens,隐式缓存0.25美元/百万tokens。Alibaba Qwen表示下周将开放Qwen3.8-Max及Qwen3.8-27B的权重。AI模型Qwen3.8-MaxAlibaba_QwenFrontend Code Arena推荐理由:阿里的Qwen3.8-Max刚发布,前端代码榜排第四,分数紧咬Claude和Kimi,下周还开源权重,可以蹲一下。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
11:11lmarena.ai@lmarena_aiQwen3.8-Max在Vision Arena基准中排名第二,获得1305分。榜首是Claude Fable 5(High),领先优势仅13分。这一差距表明两者在视觉任务上的表现非常接近。AI模型Qwen3.8-MaxVision ArenaClaude Fable 51 个信源在谈事件专题推荐理由:Qwen3.8-Max在视觉榜单冲到第二,只比Claude Fable 5低13分,想看看国产视觉模型底子的可以关注。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
10:35IT之家(博客/媒体)阿里巴巴今日发布千问 Qwen3.8-Max,参数规模达 2.4 万亿。官方称其在编程、真实办公、长程任务与多模态智能体方面实现提升。该模型能以极少人工介入端到端完成复杂开放目标。模型权重将于下周开源。AI模型Qwen3.8-Max阿里巴巴智能体推荐理由:千问新模型 Qwen3.8-Max 有 2.4 万亿参数,编程办公更强,端到端自主干活,下周还开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
05:45官方一手marktechpost@Asif Razzaq阿里Qwen团队预览了Qwen3.8-Max-Preview,该模型拥有2.4万亿参数,采用MoE架构,自称性能仅次于Fable 5。预览版已在Token Plan、Qoder和QoderWork上以标准定价的10%提供服务。官方未公布任何基准测试表格、模型卡或许可证,也未说明激活参数数量。读者需区分阿里的确认信息与声称内容。AI模型Qwen3.8-MaxAlibabaKimi K310 个信源在谈事件专题推荐理由:阿里放了个大招,Qwen3.8-Max有2.4万亿参数,号称仅次于Fable 5,但没给具体跑分,价格只要十分之一,值得关注。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
17:15IT之家(博客/媒体)73°阿里千问推出 Qwen3.8-Max-Preview 模型,参数量达 2.4T。该预览版已首发上线千问 PC 端及 Web 端,用户可在模型列表勾选体验。相较于前代旗舰 Qwen3.7-Max,新模型在内部真实任务测评中能力显著提升,涵盖全栈开发、数据分析、Office 办公工作流等复杂场景。正式版将于近期发布,届时同步上线 PC 端和 App。AI模型Qwen3.8-Max-Preview阿里千问Qwen3.8-Max推荐理由:阿里千问刚更新了 Qwen3.8-Max-Preview,参数量 2.4T,比上一代 Qwen3.7-Max 更强,PC 和 Web 端都能直接用了,快去试试吧。原文稍后读已读值得跟进有用关注 Qwen3.8-Max-Preview