AITOPAI热报
今日精选全部动态早读东盟 AIAgent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOPAI热报

百灵

共 2 条相关 AI 资讯
8月8日
07:55
07:55IT之家(博客/媒体)
蚂蚁集团百灵大模型宣布正式开源 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等版本。该模型支持 API 调用、单机私有化和高性能部署三种落地方式,在指定 GPU 测试配置下平均输出速率突破 1100 tokens/s。在 Artificial Analysis 榜单中,Ling-3.0-flash 输出速度为 353 tokens/s,AA Intelligence Index 中每项任务加权平均调用成本约 0.04 美元。8 月 7 日至 8 月 31 日,Ling Studio 上可享 2.5 折优惠。
AI模型Ling-3.0-flash蚂蚁集团百灵

推荐理由:蚂蚁百灵开源了 Ling-3.0-flash,124B 总参只激活 5.1B,能单机跑,输出超 1100 tokens/s。
原文
7月24日
22:00
22:00IT之家(博客/媒体)
蚂蚁集团百灵大模型发布Ling-3.0-flash混合推理模型,总参数量124B,激活参数仅5.1B。采用原生混合线性注意力架构(5:1交替堆叠KDA与MLA)及1/64稀疏MoE,能力对标上一代1T旗舰Ring-2.6-1T。在长上下文、Agent等场景下实现性能越级,长输入TTFT降低60%至80%+。目前已开放限时免费API调用至8月3日,之后将开源模型权重。
AI模型百灵Ling-3.0-flash蚂蚁集团

推荐理由:蚂蚁新出的Ling-3.0-flash用124B参数(仅激活5.1B)就打平了1T的旗舰模型,还能支撑复杂Agent任务,现在免费试用,8月3日后开源,别错过。
原文
精选动态早读东盟登录