遇见数据集

KrishnAI7/autotrain-data-aniaitokenclassification

收藏
Hugging Face2023-06-13 更新2024-03-04 收录
官方服务:

资源简介:

该数据集是为aniaitokenclassification项目自动处理的AutoTrain数据集,语言为英语。数据集包含token序列和对应的标签序列,标签类别包括COMPANY, LOC, O, ORG, PER, THING。数据集分为训练集和验证集,训练集有23个样本,验证集有6个样本。

该数据集是为aniaitokenclassification项目自动处理的AutoTrain数据集,语言为英语。数据集包含token序列和对应的标签序列,标签类别包括COMPANY, LOC, O, ORG, PER, THING。数据集分为训练集和验证集,训练集有23个样本,验证集有6个样本。

提供机构:
KrishnAI7
原始信息汇总

数据集概述

语言

  • 数据集语言代码为en

数据集结构

数据实例
  • 数据实例包含以下字段:
    • tokens: 字符串序列,表示文本中的单词。
    • tags: 标签序列,表示每个单词的分类,分类包括COMPANY, LOC, O, ORG, PER, THING
数据集字段
  • 数据集主要包含两个字段:
    • tokens: 字符串序列特征。
    • tags: 分类标签序列特征,标签包括COMPANY, LOC, O, ORG, PER, THING
数据集分割
  • 数据集被分割为训练集和验证集,具体分割如下:
    • 训练集样本数:23
    • 验证集样本数:6
二维码
社区交流群
二维码
科研交流群
商业服务