NLP大模型自监督学习预训练领域,竞争格局呈现巨头主导、差异化发展的态势:海外以OpenAI、Google、Meta等企业领跑通用大模型,国内百度、腾讯、华为凭借技术储备和生态优势形成第一梯队,而垂直领域企业如科大讯飞则在语音NLP等细分方向寻求突破。

巨头主导通用大模型,国产厂商加速追赶

在NLP大模型方向,自2018年BERT和GPT系列模型兴起后,参数量爆炸式增长成为显著特征。OpenAI的GPT系列和Google的T5模型是海外代表性成果,ChatGPT的发布更引发行业广泛关注。国内方面,百度、阿里巴巴等公司也已陆续发布自研大模型。其中,百度文心一言在国内进展最快,已开放网页公测,其水平大致相当于GPT-2.5的水平。

国产第一梯队:百度、腾讯、华为各有所长

国内大模型技术储备最丰富、进展最靠前的三家厂商是百度文心一言、腾讯混元和华为盘古。三者的商业模式落地思路相近,主要区别在于生态:百度和腾讯作为互联网厂商,在C端数据样本收集上更具优势;华为则凭借对行业的深入理解,更侧重B端应用。腾讯在NLP和CV大模型子分类中发展潜力较大,百度在多模态模型(主要依赖搜索业务数据)上可能有所突破,华为则在工业、能源、交通等垂直行业领域做深做透。

常见问题

国内NLP大模型相比海外差距有多大?

目前国内领先的百度文心一言大致相当于GPT-2.5的水平,落后OpenAI约三年多。未来关键在于能否像GPT一样实现快速迭代。

科大讯飞等垂直企业在NLP领域如何竞争?

垂直领域企业如科大讯飞在语音NLP等细分方向进行差异化竞争,但多数企业仍以小模型为主,为特定场景提供智能解决方案,商业模式已较成熟。

未来两三年大模型竞争趋势是什么?

腾讯、百度将选择各自优势行业场景发展,模型样本数量缩小但精度提高。华为则可能在多个行业应用领域深入,依赖行业数据做深特定场景。

延伸阅读