HydraLM/partitioned_v2_standardized_08
收藏资源简介:
--- dataset_info: features: - name: message dtype: string - name: message_type dtype: string - name: message_id dtype: int64 - name: conversation_id dtype: int64 - name: dataset_id dtype: string - name: unique_conversation_id dtype: string splits: - name: train num_bytes: 63484239.644193426 num_examples: 124197 download_size: 10735759 dataset_size: 63484239.644193426 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "partitioned_v2_standardized_08" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 数据特征: - 字段名:`message`,数据类型:字符串 - 字段名:`message_type`,数据类型:字符串 - 字段名:`message_id`,数据类型:64位整数 - 字段名:`conversation_id`,数据类型:64位整数 - 字段名:`dataset_id`,数据类型:字符串 - 字段名:`unique_conversation_id`,数据类型:字符串 数据集划分: - 划分名称:`train`,占用字节数:63484239.644193426,样本总数:124197 下载大小:10735759 数据集总存储大小:63484239.644193426 配置项: - 配置名称:`default`(默认配置) 数据文件: - 对应划分:`train`,文件路径:`data/train-*` --- # 「partitioned_v2_standardized_08」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集特征
- message:字符串类型
- message_type:字符串类型
- message_id:整数类型(int64)
- conversation_id:整数类型(int64)
- dataset_id:字符串类型
- unique_conversation_id:字符串类型
数据集分割
- train:
- 样本数量:124197
- 数据大小:63484239.644193426字节
数据集大小
- 下载大小:10735759字节
- 数据集总大小:63484239.644193426字节
配置信息
- config_name:default
- data_files:
- split:train
- path:data/train-*



