07:55IT之家(博客/媒体)蚂蚁集团百灵大模型宣布正式开源 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等版本。该模型支持 API 调用、单机私有化和高性能部署三种落地方式,在指定 GPU 测试配置下平均输出速率突破 1100 tokens/s。在 Artificial Analysis 榜单中,Ling-3.0-flash 输出速度为 353 tokens/s,AA Intelligence Index 中每项任务加权平均调用成本约 0.04 美元。8 月 7 日至 8 月 31 日,Ling Studio 上可享 2.5 折优惠。AI模型Ling-3.0-flash蚂蚁集团百灵推荐理由:蚂蚁百灵开源了 Ling-3.0-flash,124B 总参只激活 5.1B,能单机跑,输出超 1100 tokens/s。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
20:39IT之家(博客/媒体)蚂蚁百灵开源了原生混合推理模型 Ling-3.0-flash。华为同步完成昇腾 0 Day 适配,兼容 A2、A3 系列产品,分别需要 8 卡和 4 卡。适配过程首次引入 CANN PyPTO 算子编程框架,基于 PTO ISA 的 Tile 编程范式实现自动化。CANNBot PyPTO Agent 将算子开发拆成 7 个阶段,全程无需人工介入。AI产品Ling-3.0-flash昇腾CANN PyPTO推荐理由:华为把昇腾适配到蚂蚁百灵 Ling-3.0-flash 了,还推出 CANN PyPTO 框架,写算子的活能自动跑完。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
10:09官方一手Pandaily@contact@pandaily.com (Pandaily)蚂蚁集团旗下Ant Bailing推出Ling-3.0-flash执行模型,总参数量124B,激活参数仅5.1B。该模型在12个基准测试中,以12%的参数量在11项上超越万亿参数模型Ring-2.6。在34个评估维度中,Ling-3.0-flash获得15个第一、19个第二,与DeepSeek V4 Flash并列平均最高分。AI模型Ling-3.0-flashAnt BailingRing-2.610 个信源在谈事件专题推荐理由:蚂蚁百灵的新模型Ling-3.0-flash参数量只有124B,却在大多数基准测试里干翻了万亿参数的Ring-2.6,还和DeepSeek V4 Flash并列第一,小模型也能这么猛。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
02:46官方账号vLLM@vllm_project72°蚂蚁集团Ling团队发布Ling-3.0-flash,一款124B参数的MoE模型,每个token仅激活5.1B参数。该模型采用混合线性注意力机制,支持原生256K上下文窗口,面向生产级智能体系统。vLLM项目祝贺其发布,并称赞其“先公告后开源”的发布模式。vLLM将在模型权重开源时提供支持,预计vLLM开源支持即将到来。AI模型Ling-3.0-flashAntLingAGIvLLM推荐理由:蚂蚁的Ling-3.0-flash参数大但激活少,256K上下文,vLLM确认后续支持,开源在即。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
22:00IT之家(博客/媒体)蚂蚁集团百灵大模型发布Ling-3.0-flash混合推理模型,总参数量124B,激活参数仅5.1B。采用原生混合线性注意力架构(5:1交替堆叠KDA与MLA)及1/64稀疏MoE,能力对标上一代1T旗舰Ring-2.6-1T。在长上下文、Agent等场景下实现性能越级,长输入TTFT降低60%至80%+。目前已开放限时免费API调用至8月3日,之后将开源模型权重。AI模型百灵Ling-3.0-flash蚂蚁集团推荐理由:蚂蚁新出的Ling-3.0-flash用124B参数(仅激活5.1B)就打平了1T的旗舰模型,还能支撑复杂Agent任务,现在免费试用,8月3日后开源,别错过。原文稍后读已读值得跟进有用关注 百灵
06:30官方账号Nous Research@NousResearch精选蚂蚁集团(AntLingAGI)发布新MoE模型Ling-3.0-flash,总参数124B,激活参数5.1B,运行速度快。该模型专为智能体工作负载设计,涵盖编码、搜索、研究和工具使用场景。即日起一周内,用户可通过Nous Portal免费使用。AI模型Ling-3.0-flashAntLingAGINousResearch推荐理由:蚂蚁发了新MoE模型Ling-3.0-flash,124B参数但只激活5.1B,跑得快,还免费一周。适合搞智能体、编码或搜索任务,快去体验。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
06:09OpenRouter@OpenRouterAILing-3.0-flash是一款124B参数的MoE模型,每token仅激活约5.1B参数,由Novita Labs提供。该模型已在OpenRouter平台上线,主打token高效的agentic推理。即日起至8月3日可免费使用。AI模型Ling-3.0-flashNovita LabsOpenRouter推荐理由:想省token跑agentic任务?试试Ling-3.0-flash,124B参数只激活5B,OpenRouter上免费到8月3日。原文稍后读已读值得跟进有用关注 Ling-3.0-flash