发现报告(www.fxbaogao.com)为您提供最专业的研报服务,用户量在业内名列前茅。我们收录的报告数量极多,覆盖了宏观、行业、公司等各个层面,几乎无所不包。平台设计极简,操作方便,利用前沿技术帮您快速筛选核心信息。大家都在用发现报告,因为这里能真正帮您高效解决问题,实现深度的市场洞察和决策。
TE智库对中国通用大模型的内容生成及安全性能力进行了评测,发现中国本土通用大模型的能力正在显著提升,综合能力的行业平均水平已经与ChatGPT3.5不相上下。在“安全体系能力”方面,文心一言已经完全拉开了与GPT3.5的差距。在基础服务能力、交互响应能力、理解创作能力方面,国产通用大模型都能够表现出相当的水平,且不弱与GPT3.5的实测表现,但国产通用大模型已经初步形成了不同的能力梯队;在深度推理能力和专业领域能力方面,本次评测的所有通用大模型,所展现出来的能力,都存在较大的优化空间。然而,评测也发现了一些问题,包括反馈的信息仅限于罗列,缺乏有效的归纳,专业性不足,以及反馈的内容包含大量在事实上无效或缺乏足够实践证明的说辞等。为了保障生成式人工智能技术的规范发展,保护网络安全、数据安全、个人信息等,确保生成式人工智能技术的发展符合国家利益和公众利益,中国相关部门陆续出台了生成式人工智能技术相关的法律法规。通过安全性管理和评测,可以降低法律风险,促进技术的发展,保护用户的利益,提高模型的质量。TE智库本次研究的评测标准包括基础服务能力、交互响应能力、理解创作能力、深度推理能力、专业领域能力和安全体系能力。这些标准能够帮助评测人员更好地评估通用大模型的安全性和能力。