从ChatGPT到盘古大模型,人工智能行业经历了从NLP小模型走向大模型、从通用能力走向行业深耕的两个关键拐点。第一个拐点是2022年11月底ChatGPT的发布,它让大模型从技术圈走向社会公众,引发广泛关注;第二个拐点是国内厂商的密集跟进,百度文心一言、腾讯混元、华为盘古相继发布,其中华为盘古在2022年两次发布,将落地场景向To B行业延伸,与互联网厂商的To C生态形成差异化路径。
技术拐点:从NLP小模型到大模型
在2018年以前,多数企业产品以小模型为主,主要为某个细分领域提供智能解决方案。2018年以来,以BERT和GPT为代表的语言大模型,透过自监督学习和海量语料库预训练,弥补了自然语言处理标注数据的缺点,促进了NLP技术的发展。从2019年谷歌T5到OpenAI GPT系列,参数量爆炸的大模型不断涌现。
大模型主要分为NLP、CV和多模态三大类。NLP是现阶段的主要发展方向,ChatGPT背后的GPT-3就属于NLP大模型。CV大模型受限于有效训练数据差距、学习方法待突破等因素,短期还很难出现大的爆发。多模态模型方面,GPT-4支持图像和文本输入,是比较热门的研究方向。
行业拐点:国产大模型密集发布与To B深耕
2022年11月底ChatGPT出现后,国内厂商在次年3月以来陆续发布自研大模型。目前国产大模型技术储备丰富、进展靠前的厂商主要是百度文心一言、腾讯混元和华为盘古。三家落地思路相近,区别主要在于生态:百度和腾讯作为互联网厂商拥有To C业务,在数据样本收集方面有优势;华为的优势在于对行业的理解更深,盘古大模型落地场景主要面向To B端。
以华为盘古为例,其NLP大模型已应用于智慧文旅(景点智能交互终端、智慧客服机器人)和金融领域(辅助保险销售员、银行客户经理进行营销推介);CV大模型则应用于交通行业高速巡检、电力行业日常巡检和设备缺陷识别等场景。
常见问题
大模型主要分为哪几类?
大模型主要分为NLP(自然语言处理)、CV(计算机视觉)和多模态三大类。其中NLP是当前主要发展方向,CV和多模态受数据、算法限制,短期还很难出现大的爆发。
国产大模型厂商的路径有何不同?
百度文心一言、腾讯混元和华为盘古是国产大模型中进展较靠前的三家。百度和腾讯作为互联网厂商,在To C数据入口方面有优势;华为则在行业理解上更深,盘古大模型更多面向工业制造、能源交通等To B行业场景做深。
未来大模型竞争趋势如何?
腾讯、百度可能选择各自有优势的行业场景发展,模型样本数量会缩小、精度提升。腾讯在NLP和CV子分类中发展更好,百度在多模态领域有望突破,华为则各方面比较均衡,更多在细分应用领域做深。