蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash:124B 总参数量,能力对标上一代旗舰 Ring-2.6-1T
7 月 24 日消息,蚂蚁集团旗下百灵大模型今日发布百灵新一代原生混合推理模型 Ling-3.0-flash。
官方表示,相比上一代 1T 级旗舰思考模型 Ring-2.6-1T,Ling-3.0-flash 的总参数量为 124B(约为 Ring-2.6-1T 的 12.4%),激活参数量仅为 5.1B(约为 Ring-2.6-1T 的 8.1%),却实现了全方位的能力对标甚至超越。
据介绍,Ling-3.0-flash 的核心改进体现在如下几个方面:
混合线性架构,原生进化:从预训练伊始即采用原生混合线性注意力架构(5:1 交替堆叠 KDA 与 MLA),并升级全新 KDA 细粒度对角门控与 1/64 稀疏 MoE。在 124B 总参数、5.1B 激活参数规模下,实现了长上下文效率、状态记忆与计算成本的协同跃升。
极致智能密度,越级挑战:追求“快、省、可落地”的智能密度与智效比极限,在直面更大尺寸竞对 SOTA 及上一代旗舰时实现性能越级。仅需 5.1B 激活参数即可提供卓越的传统推理、指令遵循与长文本能力,全面赋能复杂 Agent 场景的高效落地。
Agent 全面进化,长程闭环:围绕真实生产力场景深度打磨,扩展 10,000+ 可交互训练环境,实现 Coding、General 与 Deep Research Agent 任务的全程闭环,做到“能力强、响应快、协同稳”。同时创新接入 SGLang HiCache + Mooncake 分级缓存架构(物理双池、集群共享 L3),使长程交互无需重算,长输入下 TTFT 降低 60% 至 80%+。

官方在 OpenRouter 与百灵官方平台同步开放限时免费 API 调用,免费期截至 8 月 3 日 23:00(北京时间),Ling-3.0-flash 模型权重将在免费期结束后正式开源。
附 OpenRouter 体验地址:
声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!
AI 中文社