📊 影响分析
RLVR技术提升大模型在数学、代码等硬逻辑任务上的能力,但开放式任务仍存瓶颈,利好算力芯片及垂直大模型公司。
事件触发 ⚡
可验证奖励的强化学习(RLVR)在数学、代码等硬逻辑任务上表现优异,但开放式任务仍依赖人工,技术瓶颈引发产业关注
产业链传导 🔄
RLVR技术需要大量算力进行奖励模型训练和多次采样,推动算力需求增长,同时垂直领域模型迭代加速
受益赛道 📈
AI训练推理芯片、垂直大模型(编程、数学方向)直接受益,算力基础设施需求提升
核心标的 🏢
国产AI算力芯片龙头寒武纪直接受益于RLVR带来的算力增量需求
寒
寒武纪 688256AI训练推理芯片需求增长,RLVR强化学习算力消耗增加
数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。