根据提供的文本,未直接提及反映我国高质量数据集“质量低”的具体数据。文本中更多聚焦于高质量数据集发展面临的供给不足、技术不成熟、来源单一、运营不完善等问题,例如:
- 中文开源数据集数量仅为英文开源的11%,且多集中于基础文本领域,缺乏高质量的多模态标注数据[2];
- 多数主体存在“重建设轻运营”倾向,数据质量依赖人工检查、安全风险防控薄弱[4]。
这些内容主要反映的是数据集在供给规模、类型多样性、全生命周期质量管控等方面的短板,而非直接通过数据指标(如错误率、不完整率等)体现“质量低”。因此,文本中暂无直接数据表明我国高质量数据集质量低,更多是发展过程中需改进的结构性问题。