← 返回产研社
字节讨论训练5万亿参数模型
产研7*24
·
9小时前
·
基础模型突破
📖 内容分析
晚点 LatePost 今天(6 日)晚间爆料称,字节跳动正在讨论训练一个参数规模超 5 万亿的模型,超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。通常而言,模型规模越大,智能水平往往越高,不过该计划仍处于早期阶段。消息称该模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。二人均是字节跳动 AI 及大模型研发体系内的核心骨干,并出自字节的“搜广推”体系。项亮本科毕业于中国科学技术大学,博士就读于中国科学院自动化研究所,2016 年加入字节,曾负责机器学习中台 AML 团队,后调任豆包大模型 Foundation 团队任负责人。沈科 2018 年清华毕业,同年加入字节,现主要负责 LLM 预训练数据。IT之家从报道中获悉,多名字节跳动人士透露,上半年多个 Seed 团队已开始不断反思,而这也是字节讨论训练超 5 万
📊 影响分析
字节跳动启动超大规模模型训练,直接拉动AI算力基础设施需求,利好相关硬件厂商。
🔗
逻辑传导链
事件触发 ⚡
字节跳动启动国内最大规模AI大模型训练,参数超5万亿,对标阿里、月之暗面,AI军备竞赛升级
5万亿
参数
模型参数规模
早期
阶段
项目进展
阿里Qwen 3.8-Max
对标
国内竞品规模
产业链传导 🔄
超大规模训练直接拉动算力需求暴增,传导至GPU服务器、高速互联、液冷散热、电力等基础设施环节
30-50万张
张
预估所需H100等效GPU数量
100-200亿
元
单次训练硬件投入估算
3-6个月
月
单次训练周期预估
受益赛道 📈
AI算力基础设施全链条受益,包括GPU芯片、AI服务器、光模块、液冷散热、数据中心电力配套
30-50%
%
2025年国内AI服务器出货量增速预期
800G/1.6T
光模块速率
高速光模块需求爆发节点
50%+
%
液冷渗透率提升空间
核心标的 🏢
直接受益于字节跳动超大规模训练订单的国产算力硬件厂商
寒
寒武纪 688256
国产AI芯片龙头,有望获得字节训练推理芯片订单
中
中际旭创 300308
高速光模块核心供应商,800G/1.6T需求激增
工
工业富联 601138
AI服务器代工龙头,字节核心供应商
浪
浪潮信息 000977
国产AI服务器领军,受益于字节大规模集群采购
英
英维克 002837
液冷散热龙头,高功率AI服务器液冷方案核心受益
数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。