bh8648/split_dataset_16
收藏资源简介:
--- dataset_info: features: - name: instruction dtype: string - name: output dtype: string - name: page_num dtype: int64 splits: - name: train num_bytes: 901169 num_examples: 212 download_size: 430289 dataset_size: 901169 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "split_dataset_16" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 特征项: - 字段名:指令(instruction),数据类型:字符串(string) - 字段名:输出(output),数据类型:字符串(string) - 字段名:页码(page_num),数据类型:64位整型(int64) 数据集划分: - 划分名称:训练集(train),占用字节数:901169,样本数量:212 下载大小:430289 数据集总大小:901169 配置项: - 配置名称:默认配置(default),数据文件: - 数据集划分:训练集(train),文件路径:data/train-* --- # 「split_dataset_16」数据集卡片(Dataset Card) [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
- 特征:
instruction: 类型为字符串output: 类型为字符串page_num: 类型为整数 (int64)
- 分割:
train: 包含212个样本,占用901169字节
- 下载大小: 430289字节
- 数据集大小: 901169字节
配置
- 配置名称: default
- 数据文件:
train: 路径为data/train-*



