遇见数据集

unlimitedbananas/second-model-our-captions

收藏
Hugging Face2023-05-16 更新2024-03-04 收录
官方服务:

资源简介:

--- dataset_info: features: - name: 'Unnamed: 0' dtype: int64 - name: video-id dtype: int64 - name: fold-ind dtype: int64 - name: startphrase dtype: string - name: sent1 dtype: string - name: sent2 dtype: string - name: gold-source dtype: string - name: ending0 dtype: string - name: ending1 dtype: string - name: ending2 dtype: string - name: ending3 dtype: string - name: ending4 dtype: string - name: ending5 dtype: string - name: ending6 dtype: string - name: ending7 dtype: string - name: ending8 dtype: string - name: ending9 dtype: string - name: ending10 dtype: string - name: ending11 dtype: string - name: ending12 dtype: string - name: ending13 dtype: string - name: ending14 dtype: string - name: ending15 dtype: string - name: ending16 dtype: string - name: ending17 dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 1368126 num_examples: 2004 download_size: 383393 dataset_size: 1368126 --- # Dataset Card for "second-model-our-captions" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

数据集信息: 特征字段: - 名称:未命名列0,数据类型:int64 - 名称:视频ID(video-id),数据类型:int64 - 名称:折数索引(fold-ind),数据类型:int64 - 名称:起始短语(startphrase),数据类型:字符串 - 名称:sent1,数据类型:字符串 - 名称:sent2,数据类型:字符串 - 名称:标准答案来源(gold-source),数据类型:字符串 - 名称:候选结尾0(ending0),数据类型:字符串 - 名称:候选结尾1(ending1),数据类型:字符串 - 名称:候选结尾2(ending2),数据类型:字符串 - 名称:候选结尾3(ending3),数据类型:字符串 - 名称:候选结尾4(ending4),数据类型:字符串 - 名称:候选结尾5(ending5),数据类型:字符串 - 名称:候选结尾6(ending6),数据类型:字符串 - 名称:候选结尾7(ending7),数据类型:字符串 - 名称:候选结尾8(ending8),数据类型:字符串 - 名称:候选结尾9(ending9),数据类型:字符串 - 名称:候选结尾10(ending10),数据类型:字符串 - 名称:候选结尾11(ending11),数据类型:字符串 - 名称:候选结尾12(ending12),数据类型:字符串 - 名称:候选结尾13(ending13),数据类型:字符串 - 名称:候选结尾14(ending14),数据类型:字符串 - 名称:候选结尾15(ending15),数据类型:字符串 - 名称:候选结尾16(ending16),数据类型:字符串 - 名称:候选结尾17(ending17),数据类型:字符串 - 名称:标签(label),数据类型:int64 划分集: - 名称:训练集,字节数:1368126,样本数:2004 下载大小:383393 数据集总大小:1368126 --- # "second-model-our-captions"数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

提供机构:
unlimitedbananas
原始信息汇总

数据集概述

数据集特征

  • Unnamed: 0:整数类型
  • video-id:整数类型
  • fold-ind:整数类型
  • startphrase:字符串类型
  • sent1:字符串类型
  • sent2:字符串类型
  • gold-source:字符串类型
  • ending0ending17:字符串类型
  • label:整数类型

数据集分割

  • train
    • 存储大小:1368126字节
    • 示例数量:2004

数据集大小

  • 下载大小:383393字节
  • 数据集大小:1368126字节
二维码
社区交流群
二维码
科研交流群
商业服务