一、大模型行业概览
- 起源:2012年深度学习突破(AlexNet、GPU应用)奠定基础,2017年Transformer结构推动自然语言处理发展,2018年Facebook推出ERNIE-Health,2019年谷歌推出SwitchTransformer。
- 定义:参数规模超过10亿、具备泛化能力的机器学习模型,特点包括参数规模巨大、深度结构复杂、泛化能力强、语义理解与生成/自然性。
- 发展历程:从早期深度学习模型到Transformer结构,再到大规模预训练模型的出现,逐步发展至今。
- 发展现状:
- 产业规模:2023年7月底中国已发布130个大模型,国外138个;预计2026年中国AI计算市场规模达1179亿元,生成式AI计算市场规模达802.3亿元。
- 产业价值链:涵盖行业大模型、应用层和场景层,涉及金融、医疗、办公等多个领域,大模型产业价值在于降低AI使用门槛、提升行业效率。
- 资本投入:2023上半年全球AI领域融资255亿美元,中国AI领域融资61.74亿元,但同比下降。
- 政策:国家鼓励发展通用人工智能,地方政策以鼓励为主,中央政策关注事前规范。
- 机遇与挑战:
- 机遇:TOC端改善产品、提供AIGC工具、增强产品竞争力;TOB端大模型调用、私有云部署、大模型平台。
- 挑战:训练成本高、市场生态不足、未达到标准化和数据融合、数据类型不够全面、国产GPU性能不足、关键人才短缺、非通用模型应用受限、机器人变态和伦理失范。
- 国内外大模型厂商总览:分为算力厂商、基础大模型厂商、行业大模型厂商、大模型应用厂商和大模型技术服务商。
二、大模型人才现状
- 人才发展现状:
- 行业薪资:最高薪资超过百万年薪。
- 教育&工作背景:硕士及以上教育程度要求主流,三年及以上工作经验人才受青睐。
- 行业分布:IT行业占超五成,电子、金融行业人才逐年升高。
- 城市分布:北京领先,深圳、广州、杭州、成都等地也有多个大模型公司。
- 人才变动情况:2023年1-10月大模型行业高层人事变动频繁,涉及多家大模型公司。
- 人才发展建议:
- 企业用人建议:提前布局高校校招,培养对口专业人才,重视应用人才,提供有吸引力的薪酬和项目。
- 人才流动建议:关注底层技术人才,评估创业公司背景,互联网行业技术人才可考虑大模型赛道,投身发达大城市。
三、国内主要厂商
- 百度:全栈布局,文心一言定位基座型赋能平台,拥有百人团队,招聘方向包括大模型、多模态等。
- 阿里:通义千问开源,阿里云加入大模型开源行列,拥有200+人团队,招聘方向包括大模型、多模态等。
- 腾讯:混元大模型通过腾讯云对外开放,拥有200+人团队,招聘方向包括大模型、多模态等。
- 字节跳动:抖音云雀大模型即将上线,拥有100+人团队,招聘方向以自然语言处理为主。
- 华为:盘古+器官芯片发布,区域气象预报大模型、视觉大模型等应用落地,拥有100+人团队。
- 百川智能:完成A1轮战略融资,Baichuan大模型在知识问答、文本创作领域表现突出,拥有170人团队,其中技术人员占70%-80%。
四、结语
人工智能大模型技术发展迅速,逐步落地各个行业,创造丰富价值,但仍处于从弱人工智能到强人工智能道路上的起点,需继续推动技术创新和应用,探索新的应用场景和商业模式,解决现实世界中的复杂问题,实现人工智能在更广泛领域的全面应用。