miladalsh/clusterd_authors_style_desc_no_predefined_styles
收藏资源简介:
--- size_categories: - n<1K dataset_info: features: - name: id dtype: int64 - name: inputs dtype: string - name: document_lists sequence: string - name: generations dtype: string - name: style_list sequence: string splits: - name: train num_bytes: 8203298 num_examples: 490 download_size: 1817915 dataset_size: 8203298 configs: - config_name: default data_files: - split: train path: data/train-* library_name: datadreamer tags: - datadreamer - datadreamer-0.35.0 - synthetic --- # Dataset Card [Add more information here](https://huggingface.co/datasets/templates/dataset-card-example) --- This dataset was produced with [DataDreamer 🤖💤](https://datadreamer.dev). The synthetic dataset card can be found [here](datadreamer.json).
样本规模类别: - 样本数少于1000(n<1K) 数据集信息(dataset_info): 特征列表: - 字段名:id,数据类型(dtype):int64 - 字段名:inputs,数据类型(dtype):字符串(string) - 字段名:document_lists,数据类型:字符串序列(sequence<string>) - 字段名:generations,数据类型(dtype):字符串(string) - 字段名:style_list,数据类型:字符串序列(sequence<string>) 数据集划分(splits): - 划分名称:train,占用字节数:8203298,样本总数:490 下载大小:1817915 数据集总大小:8203298 配置项(configs): - 配置名称:default 数据文件: - 对应划分:train 数据路径:data/train-* 依赖库名称(library_name):datadreamer 标签(tags): - datadreamer - datadreamer-0.35.0 - 合成数据集(synthetic) --- # 数据集卡片(Dataset Card) [补充更多信息请访问](https://huggingface.co/datasets/templates/dataset-card-example) --- 本数据集由 [DataDreamer 🤖💤](https://datadreamer.dev) 生成。该合成数据集的数据集卡片可在此处查阅:[datadreamer.json](datadreamer.json)。
数据集概述
基本信息
- 大小分类: 小于1K
- 数据集大小: 8203298字节
- 下载大小: 1817915字节
特征描述
- id: 整数类型 (int64)
- inputs: 字符串类型 (string)
- document_lists: 字符串序列类型 (sequence: string)
- generations: 字符串类型 (string)
- style_list: 字符串序列类型 (sequence: string)
数据分割
- 训练集:
- 字节数: 8203298
- 示例数: 490
配置
- 配置名称: default
- 数据文件:
- 分割: train
- 路径: data/train-*
标签
- 工具: datadreamer
- 版本: datadreamer-0.35.0
- 类型: synthetic



