← 返回产研社
Mac也能跑Kimi K3?大模型压缩突破
产研7*24
·
17分钟前
·
芯片与算力
📖 内容分析
编辑|山辉Kimi K3 开放完整权重后,不少人都跃跃欲试。2.8 万亿参数、官方 MXFP4 权重,拥有了这些,你就可以自己捣鼓这个规模巨大的模型,可以部署到本地。现实情况真有这么简单吗?有人总结,运行 Kimi K3 其实很容易,只需要 1.5TB GPU 内存、大约 8 张 H100,以...
📊 影响分析
大模型权重压缩技术突破,降低本地部署门槛,但推理仍需高端算力,利好AI芯片和服务器需求。
🔗
逻辑传导链
事件触发 ⚡
Kimi K3开放2.8万亿参数完整权重,通过内存压缩技术使128GB Mac可运行,大幅降低超大模型本地部署门槛
1.5TB→128GB
GPU内存需求降幅
2.8万亿
参数
模型规模
8张H100→1台Mac
硬件需求对比
产业链传导 🔄
模型压缩技术突破降低端侧推理硬件门槛,但训练和高端推理仍需H100等高算力芯片,拉动AI芯片和服务器需求
1.5TB→128GB
内存需求压缩比
~12x
倍
推理效率提升空间
100%
高端推理仍依赖GPU
受益赛道 📈
模型压缩工具链、端侧AI推理芯片、AI服务器及算力租赁三大赛道直接受益
50%+
%
端侧AI推理芯片市场增速
30%
%
AI服务器出货量增速
20亿元
元
模型压缩工具潜在市场规模
核心标的 🏢
模型压缩技术推动端侧推理芯片和服务器需求,寒武纪、海光信息、中科曙光等标的受益明确
寒
寒武纪 688256
端侧AI推理芯片龙头,思元系列可承接压缩后模型推理
海
海光信息 688041
国产GPU替代先锋,受益于高端推理算力需求增长
中
中科曙光 603019
AI服务器核心供应商,H800等高端服务器出货量提升
浪
浪潮信息 000977
全球AI服务器龙头,受益于算力需求爆发
优
优刻得 688158
GPU算力租赁平台,高端推理需求拉动云服务收入
数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。