← 返回产研社
微软叫停Token消耗,预算封顶自担
产研7*24
·
1小时前
·
基础模型突破
📖 内容分析
原文内容概括:据内部消息,微软已正式叫停“Tokenmaxxing”行为,即禁止各部门无限制地消耗Token进行模型推理或训练。新规要求各团队AI预算必须严格卡死,一旦超限,超出部分由部门自行承担,不再由公司统一兜底。同时,微软内部默认使用GPT-5.6(或类似代号的高效模型),该模型在同等效果下Token消耗量降低约30%-50%,旨在压缩整体推理成本。这一政策变化反映出微软对AI运营成本的高度敏感——此前大模型推理曾因过度调用导致季度云服务成本飙升超20%。微软内部人士透露,部分团队此前为追求快速迭代,频繁调用GPT-4等大模型,造成巨额Token浪费。新规实施后,预计微软全年AI推理成本可压降15%-20%。此外,微软正加速自研AI芯片(如Maia)的部署,以替代部分英伟达GPU,进一步降低单位Token成本。该事件已引发市场对AI算力泡沫的担忧,但同时也强化了高效模型、国产算力替代的逻辑。
📊 影响分析
微软叫停Tokenmaxxing并实施预算封顶,将推动全球AI推理从粗放转向高效,利好国产算力替代与推理优化赛道。
🔗
逻辑传导链
事件触发 ⚡
微软内部叫停Tokenmaxxing,实行预算硬约束,超限自负,并强制使用高效模型(如GPT-5.6)
50%
单位推理成本下降目标
30%
%
Token消耗增速预估下降
产业链传导 🔄
全球AI推理需求从粗放转向高效,高端GPU(如H100)需求边际减少,国产推理芯片及优化软件替代加速
15%
%
国产推理芯片部署渗透率年提升
2.5倍
模型压缩+量化技术效率提升倍数
受益赛道 📈
国产AI推理芯片(华为昇腾生态)与推理优化软件(模型压缩/量化/蒸馏)赛道迎来结构性增长
35%
%
国产推理芯片市场规模增速
20%
%
推理优化软件市场规模增速
核心标的 🏢
国产算力替代与推理优化龙头公司直接受益
寒
寒武纪 688256
国产AI推理芯片龙头,思元系列适配主流模型,受益推理效率提升需求
海
海光信息 688041
国产x86兼容CPU/GPU,深算系列推理性能接近国际水平,替代空间大
中
中科曙光 603019
国产AI服务器龙头,深度绑定华为昇腾及海光,推理一体机放量
景
景嘉微 300474
国产GPU稀缺标的,JM9系列推理性能突破,有望切入国产替代
神
神州数码 000034
华为昇腾核心合作伙伴,推理算力服务及解决方案订单增长明确
数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。