一、调查背景
当前,我国正深入推进“互联网+政务服务”改革和数字政府建设,部署应用智能问答系统已成为各级政府提升在线服务效能、优化用户体验、促进政策精准传达的关键抓手。本次调查研究旨在科学评估政府网站智能问答系统建设与应用现状,为国家相关政策的细化落实、地方最佳实践的推广复制、系统功能的迭代优化提供客观、详实的决策依据。
二、调查范围与方法
本次评估覆盖全国831家政府门户网站,涵盖部委门户网站、省级政府门户网站、省会及计划单列市门户网站、地级市和区县门户网站。调查指标聚焦安全可控、精准交互、服务贯通等核心维度,重点关注安全合规、使用便捷度、功能完备度和答复有效度等方面。
三、调查结果
-
智能问答整体建设态势
- 全国政务网站智能问答建设覆盖率达72%,但大模型技术渗透率仅15%。
- 系统建设呈现“基础覆盖成型、技术升级起步”的阶段性特征,分为未建设、传统规则驱动型和 大模型驱动型三种形态。
-
指标得分情况对比分析
- 大模型驱动型智能问答系统平均综合得分57.6分,显著高于传统规则驱动型智能问答系统平均得分26.6分。
- 大模型驱动型智能问答系统在安全合规度、使用便捷度、功能完备度和答复有效度等维度均表现优于传统系统。
-
大模型智能问答的表现
- 各维度发展不均衡,“答复有效度”指标平均绩效指数最高,为0.65。
- 安全合规度方面,“对连续不合规提问的安全处置”表现最优,平均绩效指数为0.99;而“对违反社会主义核心价值观敏感信息相关问题的防控”成为突出短板,平均绩效指数仅为0.18。
- 使用便捷度方面,“响应速度”和“入口醒目度”表现较高,分别为0.97和0.96;而“服务透明度”平均绩效指数仅为0.51,有较大提升空间。
- 功能完备度方面,“终端支持”和“用户评价”表现良好,分别为0.97和0.83;而“拼音识别”“延伸提问”“深度思考”等功能平均绩效指数较低,亟待重点突破。
- 答复有效度方面,“政策条款答复”和“特色信息答复”表现良好,分别为0.91和0.86;而“答复可解释性”和“知识有效性”平均绩效指数较低,分别为0.50和0.38,亟待加强建设。
四、建设成效
- 压实合规责任,守住安全运行线
- 坚守政治引领,拦截歧视风险,规范领导信息,严守隐私边界。
- 优化便捷适配,覆盖全人群需求
- 构建全链功能,贯通办事全流程
- 优化提问引导,强化智能导办,深化多轮交互,完善反馈功能。
- 优化精准应答,保障答复可信度
- 拆解复杂需求,溯源答复依据,更新知识内容,融入当地特色。
五、主要问题
- 部分安全薄弱点需重点补强
- 核心价值观引导存在缺位,意识形态风险防控不够深入,隐喻陷阱识别能力有待提升。
- 透明度适老化设计有待完善
- 透明度与合规性建设不足,适老化无障碍功能严重缺位。
- 导办与多模态交互有待提升
- 意图解析与知识效能需提升
- 针对用户复杂提问,系统对意图的解析深度与精准度不足;针对用户办事咨询,系统未能依据现行有效的政策文件、办事指南等进行回答。
六、发展建议
- 锚定战略导向,强化统筹治理体系
- 统筹技术选型与资源共享,筑牢“幻觉”防控与安全底线,强化数据要素赋能。
- 筑牢安全防线,严守合规运行底线
- 强化价值导向与权益保护类问题防控,规范涉政与敏感信息类问题处置,完善特殊场景与连续违规应对机制。
- 打造便捷体验,提升服务普惠水平
- 强化入口醒目度,提升界面友好度与服务透明度,深化适老化及无障碍改造并优化响应速度。
- 构建服务矩阵,完善全程功能支撑
- 强化基础交互与输入辅助功能,拓展深度服务与多模态交互能力,完善系统管控与用户反馈功能。
- 建立应答体系,强化答复综合效能
- 强化意图识别与精准响应能力,提升答复可解释性与一致性,保障知识有效性与特色信息供给。
- 健全迭代机制,构建长效发展生态