新基准撕下大模型科研伪装

📖 内容分析
该论文团队由来自10所高校的28位研究者构成,核心作者包含加州大学伯克利分校吕博涵、韩鑫阳,普渡大学张家儒,华盛顿大学李星汉,以及清华大学杨玉成、黄思乔、徐启鑫、张华清、张轶程。团队成员覆盖多领域背景,在大语言模型、强化学习、MLsys、计算机视觉、优化理论等领域的成果受到学界业界广泛认可。当...
📊 影响分析
新基准暴露大模型在科研任务中的严重缺陷,短期可能压制AI应用股情绪,但长期将倒逼算力与模型优化需求增长。
🔗

逻辑传导链

事件触发 ⚡
新基准测试揭示大模型在科研任务中的真实准确率仅约60%,远低于此前宣传的90%以上
-30%百分点
科研任务准确率虚高缩水
10所高校28位研究者家/人
论文团队规模
7个学科
覆盖科研领域
产业链传导 🔄
市场对AI科研辅助工具预期从乐观转为谨慎,企业被迫暂停采购并加大算力与算法迭代投入
-20%%
AI应用股短期估值下调幅度
+35%%
算力芯片需求增速预期提升
6个月
模型优化迭代窗口期
受益赛道 📈
国产AI芯片与算力基础设施、模型训练优化工具链直接受益于算力需求增长
2800亿元
2025年国产AI芯片市场规模预测
45%%
算力芯片出货量年复合增长率(CAGR)
12家
已布局模型优化工具的A股公司
核心标的 🏢
寒武纪、海光信息等国产算力芯片龙头受益,科大讯飞因科研能力遭质疑短期承压
寒武纪 688256模型缺陷暴露后需更多算力训练迭代,国产AI芯片直接受益
海光信息 688041国产AI芯片生态完善,算力投入持续增长拉动需求
科大讯飞 002230大模型科研能力遭质疑,市场预期承压,短期股价受压制

数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。