OpenAI GPT-4 已支持多模态输入,腾讯混元大模型在全球竞争中处于国内头部梯队、但整体代际落后于 OpenAI 的追赶者位置。综合技术代差、生态与数据入口来看,腾讯混元与 GPT-4 的差距主要体现在多模态能力与对外发布节奏上,但其在 NLP、CV 领域的技术储备和自营业务支撑,使其仍属于国产大模型的第一阵营。

技术代差:整体落后约三年

从行业整体看,国内大模型相较 OpenAI 存在明显代际差距。以百度文心一言为参照,其水平大约相当于 GPT-2.5,落后 OpenAI 三年多。腾讯混元大模型于 2019 年底左右立项,2021 年已获得自营业务支持,但对外发布较少,公开信息不多,技术细节尚未充分披露。相比之下,GPT-4 于 3 月 15 日发布,支持图像和文本输入并生成文本输出,在包含文本和照片的文档、图表或屏幕截图等输入上表现优秀。

生态与数据入口:腾讯的差异化优势

腾讯与百度作为互联网厂商,拥有 To C 端业务,在数据入口和数据样本收集方面比华为更有优势。腾讯在 NLP 大模型和 CV 大模型的子分类中被认为将发展得更好,这与腾讯 AI 开放平台、腾讯优图开放平台等既有布局一脉相承。在 NLP 领域专利数量上,腾讯以 2200 件位居国内厂商前列(微软 6400 件、亚马逊 500 件、百度 500 件)。华为则在行业理解深度上占优,盘古大模型更多面向 To B 端,已在智慧文旅、金融、交通巡检、电力巡检等领域落地应用。

竞争格局:三强并立,路径分化

国产大模型领域,技术储备丰富、进展靠前的厂商主要是百度文心一言、腾讯混元和华为盘古。三者落地思路相近,区别主要在生态:百度在多模态领域有望突破(多模态主要依赖搜索业务收集的覆盖多场景数据),腾讯在 NLP 和 CV 领域优势明显,华为则各方向较均衡、在行业领域做深。未来两三年,大模型样本数量会缩小,精度和质量将提升,各厂商将选择自身优势行业场景深耕。

常见问题

腾讯混元与 GPT-4 的差距有多大?

GPT-4 已支持多模态输入并对外发布,而腾讯混元对外发布较少、公开信息不多,两者在发布节奏和模态能力上存在差距。以国内整体水平衡量,国产大模型落后 OpenAI 约三年多,腾讯混元的具体代际差距需以官方后续发布和第三方实测为准。

腾讯混元在全球大模型中处于什么梯队?

腾讯混元属于国产大模型第一梯队,与百度文心一言、华为盘古并列。其优势在于 NLP 和 CV 领域的技术储备、NLP 专利数量领先,以及互联网厂商的 To C 数据入口优势。但在全球范围内,相较于 OpenAI 的 GPT-4,整体仍处追赶位置。

腾讯混元的技术强项是什么?

腾讯在 NLP 大模型和 CV 大模型的子分类中被认为将发展得更好。NLP 领域专利数量国内领先,且腾讯拥有 AI 开放平台和腾讯优图开放平台等基础布局。未来趋势上,腾讯可能会选择自身具有优势的行业场景进行发展,模型精度会更高、质量会更好。