一、智能演变
- 大模型预训练数据规模持续增长:从2018年的GPT-1(4.6GB)到2020年的GPT-3(45TB,相当于三千万本《西游记》),主要模型数据集包括维基百科、书籍、杂志期刊、Github代码等,涵盖客观知识、故事讲述能力、语言生成严谨性、逻辑推理等。
- 大模型参数量和训练成本优化:DeepSeek-V3采用MoE架构,参数量671B,训练成本557.6万美元,仅为Llama3的7%。通过FP8混合精度训练、DualPipe双向流水线优化、跨节点MoE通信优化、自适应计算分配机制等提升算力利用率,并采用强化学习直接用于基础模型训练,知识蒸馏技术缩短后训练周期。
- 大模型知识空间拓展:大模型的知识空间从个体知识空间扩展到多媒体知识空间,最终汇聚到全体人类知识空间,带来大知识、通用人工智能的可能性。
二、人机协作
- 人机协作模式演进:从人类AI(Copilot模式)、人类和AI协作(Agents模式)到AI全权代理(代理人模式),AI在协作中的角色逐渐从辅助工具转变为合作伙伴,甚至替代部分人类工作。
- 人机协作新常态:AI大模型的出现,使得人机协作进入新常态,AI成为人类提升效率、拓展能力的工具,例如在机器人设计、智能家居、内容创作、教育等领域的应用。
- 人机协作伦理思考:AI大模型的发展也带来伦理挑战,例如过度透明可能导致模型被逆向工程、决策偏见难追溯等,需要关注AI能力的提升,树立基本AI意识,试用和使用前沿AI工具,和AI一起成长。
三、产业现状
- AI大模型发布数量激增:根据LifeArchitect.ai统计,截至2025年2月20日,全球已发布534个大模型,其中中国117个。
- AI工具迅猛增长:根据To o l i f y. a i统计,截至2025年2月20日,全球已有23915个AI工具,覆盖233个分类,162万AIAPI。
- AI大模型应用场景丰富:AI大模型在消费级和企业级场景均有广泛应用,例如百度搜索、微信搜索、支付宝百宝箱、南方电网、华为云、深圳福田政务、吉利汽车、中国移动等。
- AI大模型开源策略加速AI技术普惠化:DeepSeek的开源策略正在加速AI技术普惠化,头部应用正在/即将完成深度集成(社交/搜索/推荐),聚焦交互体验;企业级场景在电力、政务、医疗等垂直领域取得突破,聚焦系统级优化。
四、教育成长
- AI大模型赋能教育:AI大模型可以用于生成教案、润色课件、出题组卷、自动阅卷、便捷搜索、快速答疑、创作辅助、实时评价等,全面提升教和学的效率。
- AI大模型推动教育模式变革:AI大模型推动教育从教师-学生二元结构转变为人工智能-教师-学生三元结构,实现因材施教、查漏补缺,让学习回到了最本真的样子。
- AI大模型促进教育范式重构:AI大模型的出现,所有学科都在经历“图灵测试”,人类借由AI重新定义知识的疆域,需要关注AI能力的提升,树立基本AI意识,试用和使用前沿AI工具,和AI一起成长。
- AI大模型提升教育效率:浙大大先生(chat.zju.edu.cn)和智海MO平台(mo.zju.edu.cn)等平台AI大模型支持的个性化学习、课程设计、教学管理,推动教育向“以学生成长为中心”的“学生-人工智能-教师” 三元结构发展。