登录
注册
个人信息
我的订单
我的报告豆
我的优惠券
我的笔记
我的阅读
我的收藏
我的下载
我的上传
我的订阅
在线客服
退出登录
回到首页
AI
搜索
发现报告
发现数据
发现专题
专题报告
专题百科
研选报告
定制报告
VIP
权益
付费社群
发现一下
行业研究
公司研究
宏观策略
财报
招股书
会议纪要
Token
低空经济
十五五
AIGC
大模型
当前位置:首页
/
行业研究
/
报告详情
个性化大模型技术实践
信息技术
2023-08-08
DataFunSummit2023:大模型与AIGC峰会
Cc
个性化大模型研报总结
01 个性化大模型简介
核心观点
:大模型个性化是必然趋势,个性化大模型应具备知识、个性、情感和记忆四位一体的类人对话智能体特征。
应用案例
:天猫精灵上的“鸟鸟分鸟”个性化大模型体验超预期,AIoT行业有望迎来“寒武纪大爆发”。
能力展示
:Modelscope创空间提供角色扮演和泛多任务化能力体验。
02 知识与个性化大模型
核心挑战
:知识幻觉是个性化大模型应用的核心问题,表现为与事实不一致、无从考证等。
原因分析
:数据重复、Bias、时效性;训练中的不完美表征学习、参数知识偏差;解码机制中的sampling问题。
解决方案
:
数据与模型
:高质量数据和大规模模型。
检索增强
:互联网搜索引擎和私域知识检索增强,包括更优的搜索query生成、FAQ知识检索排序、多路召回机制,以及更丰富的指导信号(如Fusion-in-Decoder、多粒度GroundingEvidence预测)。
训练数据
:更大规模、更高质量、更多样的训练数据(如Books/Wiki/QA等高知识密度预训练数据、大规模高质量对话数据)。
多任务学习
:数据统一、模型统一的多任务学习。
对话链路
:可干预可运营的对话链路。
03 个性化大模型中的个性
核心观点
:提升人设一致性的关键在于更强的基座模型、针对性数据增强、自动判别和反馈增强。
人格定义
:
粗粒度定义
:BigFive和MBTI16分类法,因心理学理论性高,不适合数据标注和效果评估。
细粒度定义
:638 Personality Traits,更适用于数据标注和效果评估。
实验方案
:
目标
:通过自然语言形式的人格组合描述控制对话风格,评估人格约束对基础对话体验的影响。
评测指标
:风格显著度、知识问答Acc/人设问答Acc/多轮顺畅性得分,采用人工pairwise标注。
实验结果
:
加入人格约束的影响
:风格显著度提升(>10pt),多轮顺畅性略有损失(2~4pt),特定人格(如活泼可爱、诙谐风趣)表现均衡。
不同人格表现
:悲观沮丧、幼稚、强势又善变等人格在知识问答和多轮连贯性上表现不佳。
提升风格显著度的要点
:风格多样的预训练数据、细粒度人格分类及组合、复杂指令遵循能力的提升。
04 总结与展望
核心要点
:
个性化大模型需具备知识、个性、情感、记忆四位一体特征。
提升数据质量、规模、模型大小、检索增强可减少知识幻觉。
人格可控生成需支持细粒度人格定义及组合,但知识范围可控仍是挑战。
人设幻觉问题需针对性数据增强和反馈增强。
更逼真的角色复刻依赖更细节的自然语言指令遵循能力。
开源项目
:ChatPLUG项目开源。
AI治理
:AI毒师计划招募垂直领域专家,构建AI治理中文数据集。
你可能感兴趣
1-2 个性化强化学习技术在京东新品流量分发系统中的实践与应用
文化传媒
DataFunSummit2022:决策智能在线峰会
2022-11-02
破界·深耕:腾讯AI大模型技术落地实践
腾讯
2025-07-28
大模型时代的可观测技术探索与实践
蚂蚁集团
2023-04-29
大模型概念、技术与应用实践
信息技术
厦门大学
2025-02-14
大模型时代的可观测技术探索与实践
蚂蚁集团
2023-05-15
OCR大模型技术演进与场景实践
腾讯
2025-06-12
2024爱分析·央国企数字化应用实践报告——DeepSeek引领技术潮流,央国企应重新规划大模型算力投入和应用节奏
信息技术
爱分析
2025-02-28
【点金互动易】 AlKimi 这家公司核心产品可对算力调度、调优进行观测分析,在一体化数据模型等积累了大量实践;这家公司一站式AI应用平台支持多种大模型的接入与纳管,AIGC相关技术应用已产生收入
未知机构
2024-03-25
券商知识应用实践—— Agent助力投顾个性化效率革命
腾讯
2025-12-29
徐磊-解决企业个性化代码生成准确率的核心实践
信息技术
2024年中国DevOps社区上海峰会
2024-10-30