SaleemUllah/address_dataset
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: question dtype: string - name: answer dtype: string - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 71677.78378378379 num_examples: 99 - name: test num_bytes: 8688.216216216217 num_examples: 12 download_size: 28411 dataset_size: 80366.0 --- # Dataset Card for "address_dataset" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
configs: - config_name: default data_files: - split: 训练集 path: data/train-* - split: 测试集 path: data/test-* dataset_info: features: - name: question(问题) dtype: 字符串 - name: answer(答案) dtype: 字符串 - name: input_ids(输入标识) sequence: int32 - name: attention_mask(注意力掩码) sequence: int8 - name: labels(标签) sequence: int64 splits: - name: 训练集 num_bytes: 71677.78378378379 num_examples: 99 - name: 测试集 num_bytes: 8688.216216216217 num_examples: 12 download_size: 28411 dataset_size: 80366.0 --- # address_dataset数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置信息
- 默认配置:
- 训练集:路径为
data/train-* - 测试集:路径为
data/test-*
- 训练集:路径为
数据特征
- 问题:数据类型为字符串
- 答案:数据类型为字符串
- 输入ID:序列类型为整数32位
- 注意力掩码:序列类型为整数8位
- 标签:序列类型为整数64位
数据分割
- 训练集:
- 字节数:71677.78378378379
- 样本数:99
- 测试集:
- 字节数:8688.216216216217
- 样本数:12
数据大小
- 下载大小:28411字节
- 数据集大小:80366.0字节



