遇见数据集

lowem1/cc_news_images

收藏
Hugging Face2023-08-30 更新2024-03-04 收录
官方服务:

资源简介:

--- configs: - config_name: default data_files: - split: sample path: data/sample-* - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: image dtype: image - name: text dtype: string splits: - name: sample num_bytes: 111345446.0 num_examples: 439 - name: train num_bytes: 781148720.208 num_examples: 3072 - name: test num_bytes: 319260197.166 num_examples: 1317 download_size: 1172645418 dataset_size: 1211754363.374 --- # Dataset Card for "cc_news_images" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

配置项: - 配置名称(config_name):默认配置(default) 数据文件(data_files): - 划分(split):样本(sample),路径(path):data/sample-* - 划分(split):训练集(train),路径(path):data/train-* - 划分(split):测试集(test),路径(path):data/test-* 数据集信息(dataset_info): 特征(features): - 名称(name):图像(image),数据类型(dtype):图像(image) - 名称(name):文本(text),数据类型(dtype):字符串(string) 数据集划分(splits): - 划分名称(name):样本(sample),字节大小(num_bytes):111345446.0,样本数量(num_examples):439 - 划分名称(name):训练集(train),字节大小(num_bytes):781148720.208,样本数量(num_examples):3072 - 划分名称(name):测试集(test),字节大小(num_bytes):319260197.166,样本数量(num_examples):1317 下载总大小(download_size):1172645418 数据集总大小(dataset_size):1211754363.374 --- # “cc_news_images”数据集卡片(Dataset Card) [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

提供机构:
lowem1
原始信息汇总

数据集概述

数据集配置

  • 配置名称: default
    • 数据文件:
      • 样本 (sample): data/sample-*
      • 训练集 (train): data/train-*
      • 测试集 (test): data/test-*

数据集信息

  • 特征:

    • 图像 (image): 数据类型为图像
    • 文本 (text): 数据类型为字符串
  • 数据分割:

    • 样本 (sample):
      • 字节数: 111,345,446.0
      • 样本数: 439
    • 训练集 (train):
      • 字节数: 781,148,720.208
      • 样本数: 3,072
    • 测试集 (test):
      • 字节数: 319,260,197.166
      • 样本数: 1,317
  • 数据集大小:

    • 下载大小: 1,172,645,418
    • 数据集大小: 1,211,754,363.374
二维码
社区交流群
二维码
科研交流群
商业服务