蚂蚁百灵发布高效混合推理模型

📖 内容分析
蚂蚁集团旗下百灵大模型今日发布百灵新一代原生混合推理模型 Ling-3.0-flash。官方表示,相比上一代 1T 级旗舰思考模型 Ring-2.6-1T,Ling-3.0-flash 的总参数量为 124B(约为 Ring-2.6-1T 的 12.4%),激活参数量仅为 5.1B(约为 Ring-2.6-1T 的 8.1%),却实现了全方位的能力对标甚至超越。据介绍,Ling-3.0-flash 的核心改进体现在如下几个方面:混合线性架构,原生进化:从预训练伊始即采用原生混合线性注意力架构(5:1 交替堆叠 KDA 与 MLA),并升级全新 KDA
📊 影响分析
该模型展示的高效推理能力将加速AI应用落地,带动国产AI芯片、服务器及光模块需求增长,利好产业链相关公司。 {"impact":"蚂蚁集团发布高效混合推理模型,将推动AI推理算力需求增长,利好国产AI芯片、服务器及光模块产业链。","bull":[{"name":"寒武纪","code":"688256","reason":"国产AI芯片龙头,受益推理芯片需求增长"},{"name":"海光信息","code":"688041","reason":"国产CPU/GPU领先,AI推理场景核心供应商"},{"name":"中际旭创","code":"300308","reason":"光模块龙头,AI算力网络需求持续提升"},{"name":"工业富联","code":"601138","reason":"AI服务器代工龙头,受益模型部署需求"},{"name":"浪潮信息","code":"000977","reason":"AI服务器龙头,推理算力扩容直接受益"},{"name":"科大讯飞","code":"002230","reason":"AI应用龙头,模型效率提升降低应用成本"}],"bear":[]}
🔗

逻辑传导链

事件触发 ⚡
蚂蚁集团发布百灵原生混合推理模型Ling-3.0-flash,总参数124B,激活仅5.1B,能力对标1T参数旗舰,推理效率大幅提升,算力成本显著降低。
124B参数
总参数量
5.1B激活参数
激活参数量
~80%
推理成本降幅估算
产业链传导 🔄
低激活参数+混合线性注意力架构降低推理门槛,推动AI应用规模化部署,推理算力需求爆发式增长,但单位算力成本下降,刺激更多场景落地,形成正向循环。
+150%
推理算力需求年增速预期
<10%
单位推理成本同比降幅
受益赛道 📈
国产AI推理芯片、AI服务器、高速光模块及数据中心配套产业链直接受益,推理效率提升加速边缘端与云端协同部署。
30%%
国产AI推理芯片渗透率提升空间
200亿
2025年AI推理芯片市场规模增量
800GGbps
光模块速率升级需求
核心标的 🏢
国产AI芯片龙头、服务器厂商及光模块龙头将最直接受益于推理效率提升带来的订单增长。
寒武纪 688256国产AI推理芯片核心供应商,受益于低功耗推理芯片需求爆发
中科曙光 603019AI服务器出货量领先,推理集群部署加速
中际旭创 300308高速光模块龙头,数据中心互联需求拉动800G/1.6T出货
浪潮信息 000977AI服务器市占率前三,推理场景订单增长明确
海光信息 688041国产x86架构CPU/DCU适配推理场景,算力芯片国产替代

数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。