← 返回产研社
OpenAI推出超高速模式,GPT-5.6提速14倍
产研7*24
·
42分钟前
·
基础模型突破
📖 内容分析
OpenAI公司今日发布公告,宣布以预览形式针对其最强AI模型GPT-5.6 Sol推出Ultrafast(超高速)模式。该模式在标准处理速度基础上实现了14倍的提升,最高每秒输出750个词元(Token),由Cerebras公司提供硬件支持。Cerebras以其专有的晶圆级芯片技术闻名,此次合作标志着OpenAI在推理加速领域的重大突破。OpenAI表示,在过去模型的速度和能力往往难以兼顾:如果用户需要更快的输出速度,通常需要牺牲模型能力,转而选择更小或更专用的模型。而Ultrafast模式通过专用硬件优化,在不降低模型能力的前提下实现了极速推理,目标是在用户工作流中进一步提高模型的响应速度,尤其适合需要实时反馈的AI应用如智能客服、实时翻译、代码生成等。该模式目前以预览形式提供,OpenAI计划逐步扩大可用性。这一举措不仅展示了OpenAI在模型优化和硬件协同方面的进展,也凸显了专用AI推理芯片在降低延迟、提升用户体验方面的关键作用。随着大模型参数量持续增长,推理阶段的效率瓶颈日益突出,Ultrafast模式的推出可能成为行业标杆,推动其他AI厂商加速在推理基础设施上的投入。
📊 影响分析
OpenAI超高速推理模式将加速AI算力需求增长,利好国内AI服务器、芯片及光模块厂商,但可能加剧国际竞争对国内AI应用的压力。
🔗
逻辑传导链
事件触发 ⚡
OpenAI发布GPT-5.6 Sol的Ultrafast模式,推理速度提升14倍至每秒750 tokens,由Cerebras硬件支持
14
倍
速度提升幅度
750
tokens/秒
最高输出速率
2025-06
发布时间(预览)
产业链传导 🔄
超高速推理打破速度与能力瓶颈,推动实时交互场景爆发,算力需求从训练转向推理侧,引发算力基础设施升级潮
+300%
推理算力需求预期增速
0.3
秒/千token
延时缩短至毫秒级
50%
实时应用渗透率提升空间
受益赛道 📈
AI服务器、AI推理芯片、高速光模块及液冷散热等算力基础设施赛道直接受益
1200
亿美元
2026年全球AI推理芯片市场规模
45%
国内AI服务器出货量年增速
800G
光模块速率升级方向
核心标的 🏢
国内AI算力链核心公司受益于推理需求爆发,同时面临国际竞争加速压力
中
中科曙光 603019
国产AI服务器龙头,深度适配大模型推理场景
寒
寒武纪 688256
自研推理芯片思元系列有望切入超高速推理市场
中
中际旭创 300308
高速光模块核心供应商,800G/1.6T需求受益
浪
浪潮信息 000977
AI服务器出货量国内第一,推理场景弹性大
英
英维克 002837
液冷散热方案商,高功耗GPU推理集群需求推动
数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。