遇见数据集

CCI3-HQ-Annotation-Benchmark

收藏
魔搭社区2026-07-13 更新2024-10-26 收录
官方服务:

资源简介:

# CCI3-HQ-Annotation-Benchmark These 14k samples were randomly extracted from a large corpus of Chinese texts, containing both the original text and corresponding labels. They can be used to evaluate the quality of Chinese corpora.

# CCI3-HQ标注基准测试集(CCI3-HQ-Annotation-Benchmark) 本基准测试集包含14000个从大规模中文文本语料库中随机抽取的样本,每个样本均涵盖原始文本与对应标注标签,可用于评估中文文本语料库的质量。

提供机构:
maas
创建时间:
2024-10-25
搜集汇总
数据集介绍
CCI3-HQ-Annotation-Benchmark 数据集图片
背景与挑战
背景概述
CCI3-HQ-Annotation-Benchmark数据集包含1.4万条从大型中文文本语料库中随机抽取的样本,每条样本均提供原始文本和对应标签。该数据集主要用于评估中文语料库的质量。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务