国产大模型行业从萌芽到爆发,经历了预训练技术奠基、GPT-3 引发关注、ChatGPT 引爆热潮、国产厂商密集发布等多个关键拐点。其中,2022 年底 ChatGPT 的出现是分水岭,直接推动了国内头部厂商在随后数月内集中发布自研大模型,标志着国产大模型从技术储备期进入加速落地期。
技术奠基期:从 BERT 到 GPT 系列
2018 年以来,以 BERT 和 GPT 为代表的语言大模型,通过自监督学习和海量语料库预训练,弥补了自然语言处理标注数据的短板,推动了 NLP 技术的快速发展。从 2019 年谷歌 T5 到 OpenAI GPT 系列,参数量爆炸式增长的大模型不断涌现,为后续行业爆发奠定了技术基础。
这一时期,国内大多数企业仍以小模型为主,主要为细分领域提供智能解决方案,商业模式已较为成熟,但在大模型层面尚未形成突破。
引爆拐点:ChatGPT 与国产大模型集中发布
2022 年 11 月底 ChatGPT 的出现,引发了社会各界的广泛关注,成为行业关键转折点。此后,国内百度、阿里等公司陆续发布自研大模型,行业进入密集发布期。国产大模型中,技术储备丰富、进展靠前的厂商主要是百度文心一言、腾讯混元和华为盘古。
以百度文心一言为例,其在国内进展最快,率先开放网页公测。据市场使用反馈,文心一言发布初期的水平大致相当于 GPT2.5 的水平,与国际顶尖模型存在一定代际差距,但未来重点在于能否像 GPT 系列一样实现快速迭代。
竞争格局与未来趋势
从布局来看,腾讯和百度对 NLP、CV 和多模态均有布局,华为除三类大模型外还有科学计算大模型。三家的落地思路相近,区别主要在生态:百度和腾讯作为互联网厂商,在数据入口和样本收集方面有优势;华为则凭借对行业的深入理解,更多面向 To B 端应用。
未来两三年,腾讯、百度可能选择各自优势行业场景发展,模型样本数量缩小而精度提升。腾讯在 NLP 和 CV 子分类中更具优势,百度有望在多模态领域突破,华为则更均衡,会在工业制造、能源交通等行业领域做深。
常见问题
国产大模型整体落后国际水平多少?
国产大模型整体落后约 1-3 年。以百度文心一言为例,发布初期使用感受大致相当于 GPT2.5 的水平,落后 OpenAI 三年多,但后续迭代速度是关键观察点。
国产大模型的主要参与者有哪些?
技术储备丰富、进展靠前的厂商主要是百度文心一言、腾讯混元和华为盘古。此外,阿里等互联网巨头也已陆续发布自研大模型,行业整体呈现多强竞争格局。
国产大模型未来会在哪些方向突破?
腾讯在 NLP 和 CV 大模型子分类中更具优势,百度在多模态领域有望突破,华为则各方向均衡发展,更多在工业制造、能源交通等细分行业领域做深应用。