medric49/dolly-rag-gpt4-ins
收藏资源简介:
--- dataset_info: features: - name: instruction dtype: string - name: context dtype: string - name: response dtype: string - name: category dtype: string splits: - name: train num_bytes: 7282892 num_examples: 4467 download_size: 4479160 dataset_size: 7282892 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "dolly-rag-gpt4-ins" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征项: - 字段名称:指令(instruction),数据类型:字符串 - 字段名称:上下文(context),数据类型:字符串 - 字段名称:回复(response),数据类型:字符串 - 字段名称:类别(category),数据类型:字符串 数据拆分: - 拆分名称:train(训练集),字节数:7282892,样本数量:4467 下载大小:4479160 数据集文件大小:7282892 配置项: - 配置名称:default(默认),数据文件: - 拆分:train(训练集),路径:data/train-* --- # 「dolly-rag-gpt4-ins」数据集卡片 【需补充更多信息】(https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集特征
- instruction:数据类型为字符串。
- context:数据类型为字符串。
- response:数据类型为字符串。
- category:数据类型为字符串。
数据集分割
- train:
- 数据大小:7282892字节
- 示例数量:4467个
数据集大小
- 下载大小:4479160字节
- 数据集总大小:7282892字节
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*
- split: train
- data_files:



