youngermax/text-tagging
收藏官方服务:
资源简介:
--- dataset_info: features: - name: source dtype: string - name: text dtype: large_string - name: tags sequence: string splits: - name: train num_bytes: 37321512 num_examples: 11546 download_size: 21184732 dataset_size: 37321512 configs: - config_name: default data_files: - split: train path: data/train-* task_categories: - text-generation - text-classification - text-retrieval language: - en size_categories: - 10K<n<100K --- # Dataset Card for "text-tagging" A small collection of English topic-tagged text from arxiv, Medium, Wikipedia, and grants.gov.
提供机构:
youngermax原始信息汇总
数据集概述
数据集基本信息
- 名称: text-tagging
- 语言: 英语 (en)
- 大小类别: 10K<n<100K
数据集特征
- source: 数据类型为字符串
- text: 数据类型为大型字符串
- tags: 数据类型为字符串序列
数据集分割
- 训练集 (train):
- 示例数量: 11546
- 数据大小: 37321512 字节
数据集下载与大小
- 下载大小: 21184732 字节
- 数据集总大小: 37321512 字节
任务类别
- 文本生成
- 文本分类
- 文本检索



