18:12IT之家(博客/媒体)精选73°蚂蚁百灵推出金融增强模型 Ling-3.0-flash-Fin,保持 124B 总参数和 5.1B 激活参数配置。该模型通过金融语料预训练和工具使用优化,强化了对年报、财务工作簿等复杂金融内容的处理能力。在 FinFIRST、Finance Agent 等金融智能体基准测试中,与多款通用模型相比展现出较强竞争力。模型将在 OpenRouter 提供为期一个月的限时免费 API 调用,下周将正式开源模型权重。AI模型Ling-3.0-flash-Fin蚂蚁百灵金融模型推荐理由:蚂蚁百灵的 Ling-3.0-flash-Fin 专注金融领域,API 限免一个月,下周开源,比同等模型更擅长定位官方资料。原文稍后读已读值得跟进有用关注 Ling-3.0-flash-Fin
06:58IT之家(博客/媒体)精选蚂蚁百灵开源了 Ling-3.0-tiny-base 和 Ling-3.0-flash-base 模型。官方开放了预训练、中期训练和 WSM 合并等 6 个关键训练节点权重。Ling-3.0-tiny-base 模型总参数 7.9B,在代码能力上表现优异。Ling-3.0-flash-base 模型总参数 124B,适合研究者和开发团队继续训练。这些 Base 模型并非聊天模型,不建议直接部署为面向终端用户的服务。AI模型Ling-3.0蚂蚁百灵开源模型推荐理由:蚂蚁百灵把 Ling-3.0-tiny 和 flash 的 Base 模型开源了,还把训练过程中的 6 个关键节点权重都放出来了。tiny 模型参数少但代码能力强,flash 模型参数多适合继续训练,对研究者挺有用。原文稍后读已读值得跟进有用关注 Ling-3.0
18:01IT之家(博客/媒体)精选蚂蚁百灵在 Hugging Face 开源 Ling-3.0-tiny 模型,总参数 7.9B,每 Token 激活 1.3B 参数,采用混合推理 MoE 架构。该模型将 KDA 和 MLA 按 3:1 比例交替堆叠,包含 128 个路由专家,兼顾上下文处理与计算成本。官方提供 BF16、FP8 和 INT4 权重版本,适配不同平台。在 M4 Pro MacBook 上推理速度约 86-90 Token/s,8K 上下文峰值内存约 8.34 GiB。AI模型Ling-3.0-tiny蚂蚁百灵MoE推荐理由:蚂蚁百灵开源了个轻量推理模型,7.9B 参数但每 Token 只激活 1.3B,Mac mini 上跑得飞快,适合本地部署。原文稍后读已读值得跟进有用关注 Ling-3.0-tiny
20:39IT之家(博客/媒体)蚂蚁百灵开源了原生混合推理模型 Ling-3.0-flash。华为同步完成昇腾 0 Day 适配,兼容 A2、A3 系列产品,分别需要 8 卡和 4 卡。适配过程首次引入 CANN PyPTO 算子编程框架,基于 PTO ISA 的 Tile 编程范式实现自动化。CANNBot PyPTO Agent 将算子开发拆成 7 个阶段,全程无需人工介入。AI产品Ling-3.0-flash昇腾CANN PyPTO推荐理由:华为把昇腾适配到蚂蚁百灵 Ling-3.0-flash 了,还推出 CANN PyPTO 框架,写算子的活能自动跑完。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
11:41量子位@量子位的朋友们蚂蚁百灵发布了新一代原生混合推理模型Ling-3.0-Flash。该模型在MATH-500和HumanEval基准上取得了领先成绩,推理速度相比上一代有显著提升。它支持文本与代码等多模态输入,已通过百灵开放平台提供API。AI模型Ling-3.0-Flash蚂蚁百灵推理模型推荐理由:蚂蚁百灵出了Ling-3.0-Flash,数学和代码能力强,速度更快,开发者直接调API就能用。原文稍后读已读值得跟进有用关注 Ling-3.0-Flash