2023 中国大模型落地应用案例集核心洞察
近日,中国信通院联合上海人工智能实验室成立的大模型测试验证与协同创新中心牵头,首次面向全国范围征集全行业优秀应用实践,并形成《2023 大模型落地应用案例集》(以下简称'《案例集》')。作为首部聚焦落地应用的权威研究成果,《案例集》全面展示了大模型前沿技术和发展成果,推动了大模型为代表的人工智能技术赋能社会经济高质量发展。经专家组的多轮评审,共 52 个各自领域的典型大模型技术落地应用成功入选。
本文基于中国信通院发布的《2023 大模型落地应用案例集》,系统梳理了中国大模型产业的发展现状。文章首先回顾了中国学者在 ResNet、Transformer 等底层技术上的原创贡献,列举了华为、百度、阿里、京东等企业的早期布局与参数竞赛。其次,分析了通用大模型与垂直大模型的市场分化,详细介绍了书生浦语、通义千问、MiniMax 等代表性模型及其在 ToB 和 ToC 场景的应用。最后,探讨了大模型生态构建的重要性,指出数据治理、合规性及多模态融合是未来发展的关键方向,强调构建规范可控的工具链是实现产业落地的核心。

近日,中国信通院联合上海人工智能实验室成立的大模型测试验证与协同创新中心牵头,首次面向全国范围征集全行业优秀应用实践,并形成《2023 大模型落地应用案例集》(以下简称'《案例集》')。作为首部聚焦落地应用的权威研究成果,《案例集》全面展示了大模型前沿技术和发展成果,推动了大模型为代表的人工智能技术赋能社会经济高质量发展。经专家组的多轮评审,共 52 个各自领域的典型大模型技术落地应用成功入选。
2022 年底 ChatGPT 的横空出世,引爆了国内外大模型的热情,各行各业的创业者已经集结在十字路口蓄势待发。从国内市场来看,目前人工智能(AI)大模型已经在各行各业'落子不断'。据公开资料不完全统计显示,国内大模型的发展路径是'通用 + 垂直'两条腿走路,其中垂类大模型落地速度最快。《案例集》显示,有近 65%+ 的 AI 大模型是垂直大模型。
在大模型领域细数中国学者贡献,许多原创性贡献来自本土。已故的商汤科技创始人汤晓鸥在 2023 世界人工智能大会上发表演讲时表示:在深度学习的大门上,我们按了 18 次门铃,取得了许多跨时代的突破。
深度残差学习(ResNet) 2016 年,来自微软亚洲研究院的四位学者提出深度残差学习(ResNet),解决了深度网络的梯度传递问题。要知道,2015 年之前深度学习最多只能训练 20 层,ResNet 之后,就可以有效地训练超过百层的深度神经网络。这为后续深层模型的构建奠定了坚实基础。
Transformer 架构的改进 2017 年 Google 发布 Transformer,它的出现打稳了 AI 大模型的'地基',不仅'颠覆'了自然语言处理(NLP)中的机器翻译任务,而且还提供了一种新的思路来处理图像数据。中国学者也围绕 Transformer 做了许多改进和完善:
开源体系与超算集群 林达华设计的计算机视觉开源算法体系 OpenMMLab,目前已经成为国际上最具影响力的视觉算法开源体系。值得一提的是,林达华也是书生大模型体系的重要贡献者。 京东探索研究院早在 2021 年年初就展开了大模型体系(超级深度学习)的建设和基础研究,领导京东建设了中国第一个 NVIDIA DGX Superpod 天琴 alpah-α超算集群。在此基础上,京东探索研究院的织女模型 vega v2 在 2022 年登顶 SuperGLUE 榜首,一举超越同场竞技的谷歌、微软、Meta 等业界顶尖企业;2021 年研究院开发的大规模视觉模型 ViTAE,在 ImageNet Real 的目标识别和 MS COCO 的人体姿态估计等权威榜单上均获得世界第一。
因此,国内公司的 AI 大模型研发虽然比国外公司晚,但是发展却异常地迅速,其内在逻辑便是:本土企业和学者对深度学习技术的深入理解与创新。在大模型的底层技术已经固定的时代,他们靠着持续的探索和努力才能构建出秀丽的'上层建筑'。
在 OpenAI 发布 ChatGPT 之前,国内的一些企业就已经押注 AI 大模型技术:例如 2021 年 4 月,华为云联合循环智能发布盘古超大规模预训练语言模型,参数规模达 1000 亿;2021 年 6 月,北京智源人工智能研究院发布了超大规模智能模型'悟道 2.0',参数规模达到 1.75 万亿;2021 年 12 月,百度推出 ERNIE 3.0 Titan 模型,参数规模达 2600 亿,同期,阿里巴巴达摩院的 M6 模型参数达到 10 万亿,将大模型参数直接提升了一个量级。
到 2023 年,大模型继续火热,国内的 AI 大模型团队已逐渐拓展到视觉、决策领域,甚至用于解决蛋白质预测、航天等领域的重大科学问题,阿里、京东、OPPO 等大厂都有相应的成果。
图灵奖获得者 Yann LeCun 说过:AI 大模型的技术都是公开的,算不上底层技术上的创新,如果你愿意一探究竟的话,可以发现它背后没有任何秘密可言。但借着这些'过时'的技术,在中国拥有庞大的人才基数和数据集的情况下,可以发展出更适合本土环境和语境的大模型。
那么如何形象理解大模型?前科技部长王志刚从高维度表示,大模型就是大数据、大算力、强算法。形象一些:大模型事实上就是算法、数据、算力上的有效结合。传统巨头在大模型领域的技术投入普遍都是在积极防御,而中国企业在非常积极地推动向应用中的落地。
目前,业界除了把 AI 大模型商业落地模式统分为 toB 和 toC 之外,在市场划分上则遵循通用与垂直两大路径,两者在参数级别、应用场景等方面差异正在显性化。
通用大模型往往是指具备处理多种不同类型任务的 AI 模型,这些模型通常是通过大规模的数据训练而成,能够在多个领域和应用中表现出良好的效能。大家耳熟能详的几个通用大模型均来自财力雄厚的企业:
这些通用大模型包含千亿甚至万亿参数,覆盖自然语言处理、图像识别、语音识别等方面的任务,已在知识问答、医疗咨询、娱乐领域、视频生成等数十个行业场景领域,展现出广阔的落地应用潜力。
与通用大模型相比,垂类大模型参数量相对较小。但是因为有一些行业的核心数据和业务系统的生产数据参与,所以在相应行业解决问题更为高效、直接。
从《案例集》来看,在金融、教育、医疗等领域,已经有不少公司发布了相应产品。根据《案例集》入选案例的应用场景,垂类大模型更针对于企业级应用场景的垂直性和专业性要求,而在模型部署层面,更少的模型参数、训练数据意味着更少的成本,因此垂直应用领域有望实现'万模齐发'。
《案例集》公布的名单,也恰恰验证了目前垂类大模型发展的一些趋势:
对于 AI 大模型这种划时代的超级机遇而言,胜负不在于做出一个爆款应用,赚到几亿盈利,而在于,是否抓到了大时代的方向。换句话说,当下的大模型竞争早已超过了技术的范畴,更多是一种生态层面的比拼,具体表现在有多少应用、有多少插件、有多少开发者以及用户等。谁能够率先围绕大模型构建生态,或者说谁率先融入生态,谁就能成为领先者。
大模型要想像电力一样输送给千行百业和千家万户,必然需要一个体系化的产业生态,构建这个生态需要一系列相互关联的因素,包括技术发展、应用场景、数据管理、伦理与法律问题、以及社会影响等。
在生态建构的路径上,目前企业可分为两派。一派将大模型接入原有的产品线,做升级和优化;另一派试图以大模型产品为中心,建构新一代的'超级应用'。而有些企业试图跳过这两种路径,多方面融入 AI 大模型生态。
从《案例集》公布的大模型服务类案例,我们可以看到有些中国企业做了以下尝试:
这些大模型服务工具,在一定程度上能有效地解决'幻觉'、'道德'、'性能'、'数据合规'等当前 AI 大模型遇到的问题。更重要的是借助这些服务,可以建设规范可控的自主工具链,帮助 AI 企业探索'大而强'的通用模型,助力公司研发'小而美'的垂直行业模型,从而构建基础大模型和专业小模型交互共生、迭代进化的良好生态。
随着技术的成熟,大模型将不再仅仅是技术名词,而是成为基础设施的一部分。未来的竞争将集中在谁能更好地将技术与实际业务场景结合,谁能提供更稳定、更安全、更低成本的模型服务。同时,数据隐私保护、算法可解释性以及社会责任也将成为衡量大模型企业的重要标准。中国企业在这一进程中,凭借庞大的数据资源和丰富的应用场景,有望在全球大模型生态中占据重要一席。
综上所述,2023 大模型落地应用案例集不仅是对过去一年的总结,更是对未来方向的指引。通过梳理底层技术、中层模型和上层应用,我们可以清晰地看到中国大模型产业的完整图谱。从 ResNet 到 Transformer,从通用模型到垂直模型,每一步都凝聚着中国从业者的智慧与汗水。面对未来,构建开放、协作、规范的生态将是持续发展的关键。

微信公众号「极客日志」,在微信中扫描左侧二维码关注。展示文案:极客日志 zeeklog
使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online
生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online
基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online
解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online
将字符串编码和解码为其 Base64 格式表示形式即可。 在线工具,Base64 字符串编码/解码在线工具,online
将字符串、文件或图像转换为其 Base64 表示形式。 在线工具,Base64 文件转换器在线工具,online