← 返回产研社
Neon开源4B检索模型成本极低
产研7*24
·
36分钟前
·
基础模型突破
📖 内容分析
原文内容概括缩写:IT之家8月7日消息,Neon(一款完全托管的无服务器PostgreSQL数据库,分离计算与存储,支持自动扩展、按需缩容至零及类似Git的数据库分支功能)昨日发布博文,宣布携手Castform公司推出一套面向检索模型的训练方案。双方开源了一款4B参数的检索模型,在文档搜索能力上超越GPT-5.6 Sol,但成本仅为后者的1/100。该模型充分利用了Neon的云原生架构特性,结合Castform在检索增强生成(RAG)领域的优化技术,实现了高效、低成本的文档检索。Neon数据库的自动扩展能力使其能够灵活适配不同规模的检索任务,而Castform的蒸馏与量化方法则大幅降低了模型推理的计算开销。这一开源项目旨在帮助开发者快速构建具备强大搜索能力的AI应用,尤其适用于智能客服、知识库管理、企业文档搜索等场景。Neon强调,该模型在标准基准测试中召回率、准确率均优于GPT-5.6 Sol,且推理延迟更低。模型权重和训练代码已在GitHub上公开,支持社区二次开发。Neon的CEO表示,数据库与AI的结合是下一代云原生应用的核心,低成本检索模型将加速AI智能体在企业的落地。
📊 影响分析
Neon开源低成本4B检索模型,将推动国内AI文档搜索与RAG应用成本骤降,利好国产算力与AI应用公司。
🔗
逻辑传导链
事件触发 ⚡
Neon与Castform联合开源4B参数检索模型,文档搜索能力超越GPT-5.6 Sol,训练和推理成本仅为后者的1/100
4B
参数
模型参数量
1/100
倍
成本降幅
超GPT-5.6 Sol
性能对比
产业链传导 🔄
低成本开源模型大幅降低企业级AI检索与RAG(检索增强生成)应用的门槛,推动数据库与AI深度融合,进而刺激算力需求与AI应用开发
80%
%
预计RAG部署成本下降幅度
3-5倍
倍
AI检索应用潜在增速
0.1元/千次
元
推理成本估算(原为10元)
受益赛道 📈
国产AI算力芯片、云原生数据库、以及AI文档搜索/智能体应用赛道将直接受益
30%
%
国产算力需求增量预期
50%
%
数据库+AI融合市场增速
2000万
美元/年
企业级RAG替代市场空间
核心标的 🏢
国产算力芯片、数据库及AI应用公司将率先受益于成本骤降带来的需求爆发
寒
寒武纪 688256
国产AI推理芯片龙头,低成本模型将带动推理芯片需求
海
海光信息 688041
国产GPU/DCU芯片供应商,受益于检索模型推理算力需求
星
星环科技 688031
云原生数据库与AI融合标杆,Neon开源模型可直接集成
拓
拓尔思 300229
AI文档搜索与RAG应用领军,低成本模型加速产品落地
科
科大讯飞 002230
AI智能体与文档搜索场景丰富,可快速接入开源模型降本
数据来源:行业公开数据、公司财报、券商研报,仅供参考,不构成投资建议。