pbaoo2705/biomedqa_processed_eval
收藏资源简介:
--- dataset_info: features: - name: 'Unnamed: 0.1' dtype: int64 - name: 'Unnamed: 0' dtype: int64 - name: id dtype: string - name: title dtype: string - name: context dtype: string - name: question dtype: string - name: answers dtype: string - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: answer dtype: string - name: start_positions dtype: int64 - name: end_positions dtype: int64 splits: - name: train num_bytes: 347583 num_examples: 100 download_size: 124060 dataset_size: 347583 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "biomedqa_processed_eval" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征: - 名称:'Unnamed: 0.1' 数据类型:int64 - 名称:'Unnamed: 0' 数据类型:int64 - 名称:id 数据类型:字符串 - 名称:title 数据类型:字符串 - 名称:context 数据类型:字符串 - 名称:question 数据类型:字符串 - 名称:answers 数据类型:字符串 - 名称:input_ids 序列:int32 - 名称:attention_mask 序列:int8 - 名称:answer 数据类型:字符串 - 名称:start_positions 数据类型:int64 - 名称:end_positions 数据类型:int64 拆分: - 名称:train 字节数:347583 样本数:100 下载大小:124060 数据集大小:347583 配置: - 配置名称:default 数据文件: - 拆分:train 路径:data/train-* --- # 数据集卡片:biomedqa_processed_eval [更多信息请参考](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
特征
Unnamed: 0.1: 数据类型为int64Unnamed: 0: 数据类型为int64id: 数据类型为stringtitle: 数据类型为stringcontext: 数据类型为stringquestion: 数据类型为stringanswers: 数据类型为stringinput_ids: 序列类型为int32attention_mask: 序列类型为int8answer: 数据类型为stringstart_positions: 数据类型为int64end_positions: 数据类型为int64
数据分割
train: 包含 100 个样本,占用 347583 字节
数据集大小
- 下载大小: 124060 字节
- 数据集大小: 347583 字节
配置
default配置包含训练数据文件,路径为data/train-*



