遇见数据集

somosnlp/somos_alpaca_validation_agreement

收藏
Hugging Face2023-04-28 更新2024-03-04 收录
官方服务:

资源简介:

该数据集是通过协作努力清理Alpaca数据集的结果,收集了标注者之间达成共识的标注。这个数据集对于识别标签分配中达成明确共识的情况非常有用,从而提高了数据的质量和可靠性。数据集包含id、annotation和count等特征,训练集有12615个示例,总大小为777430字节。

该数据集是通过协作努力清理Alpaca数据集的结果,收集了标注者之间达成共识的标注。这个数据集对于识别标签分配中达成明确共识的情况非常有用,从而提高了数据的质量和可靠性。数据集包含id、annotation和count等特征,训练集有12615个示例,总大小为777430字节。

提供机构:
somosnlp
原始信息汇总

数据集概述

数据集名称

  • 名称: somos_alpaca_validation_agreement

数据集特征

  • 特征1: id
    • 数据类型: string
  • 特征2: annotation
    • 数据类型: string
  • 特征3: count
    • 数据类型: int64

数据集分割

  • 分割名称: train
    • 数据大小: 777430 bytes
    • 示例数量: 12615

数据集大小

  • 下载大小: 477855 bytes
  • 数据集大小: 777430 bytes
二维码
社区交流群
二维码
科研交流群
商业服务