遇见数据集

dmarx/whats-in-a-name_v0.1_embeds_clip-b32

收藏
Hugging Face2023-10-08 更新2024-03-04 收录
官方服务:

资源简介:

--- dataset_info: features: - name: class_idx dtype: int64 - name: name dtype: string - name: root dtype: string - name: image_id dtype: string - name: embed_type dtype: string - name: path dtype: string - name: embed sequence: float32 - name: embed_normed sequence: float32 - name: similarity@6 dtype: float64 - name: DIV@6 dtype: float64 - name: similarity@12 dtype: float64 - name: DIV@12 dtype: float64 - name: similarity@18 dtype: float64 - name: DIV@18 dtype: float64 - name: similarity@24 dtype: float64 - name: DIV@24 dtype: float64 splits: - name: train num_bytes: 149815296 num_examples: 34200 download_size: 72810192 dataset_size: 149815296 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "whats-in-a-name_v0.1_embeds_clip-b32" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

--- 数据集信息: 特征: - 名称:class_idx(class_idx),数据类型:64位整数(int64) - 名称:name(name),数据类型:字符串(string) - 名称:root(root),数据类型:字符串(string) - 名称:image_id(image_id),数据类型:字符串(string) - 名称:embed_type(embed_type),数据类型:字符串(string) - 名称:path(path),数据类型:字符串(string) - 名称:embed(embed),数据类型:32位浮点数序列(sequence of float32) - 名称:embed_normed(embed_normed),数据类型:32位浮点数序列(sequence of float32) - 名称:similarity@6(similarity@6),数据类型:64位浮点数(float64) - 名称:DIV@6(DIV@6),数据类型:64位浮点数(float64) - 名称:similarity@12(similarity@12),数据类型:64位浮点数(float64) - 名称:DIV@12(DIV@12),数据类型:64位浮点数(float64) - 名称:similarity@18(similarity@18),数据类型:64位浮点数(float64) - 名称:DIV@18(DIV@18),数据类型:64位浮点数(float64) - 名称:similarity@24(similarity@24),数据类型:64位浮点数(float64) - 名称:DIV@24(DIV@24),数据类型:64位浮点数(float64) 数据集划分: - 划分名称:训练集(train),字节数:149815296,样本数量:34200 下载大小:72810192 数据集总大小:149815296 配置项: - 配置名称:默认配置(default),数据文件: - 数据集划分:训练集(train),路径:data/train-* --- # 「whats-in-a-name_v0.1_embeds_clip-b32」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

提供机构:
dmarx
原始信息汇总

数据集概述

数据集信息

  • 特征列表:

    • class_idx: 类型为 int64
    • name: 类型为 string
    • root: 类型为 string
    • image_id: 类型为 string
    • embed_type: 类型为 string
    • path: 类型为 string
    • embed: 类型为 float32 的序列
    • embed_normed: 类型为 float32 的序列
    • similarity@6: 类型为 float64
    • DIV@6: 类型为 float64
    • similarity@12: 类型为 float64
    • DIV@12: 类型为 float64
    • similarity@18: 类型为 float64
    • DIV@18: 类型为 float64
    • similarity@24: 类型为 float64
    • DIV@24: 类型为 float64
  • 数据分割:

    • train: 包含 34200 个样本,总字节数为 149815296
  • 数据集大小:

    • 下载大小: 72810192 字节
    • 数据集大小: 149815296 字节

配置信息

  • 配置名称: default
    • 数据文件:
      • train: 路径为 data/train-*
二维码
社区交流群
二维码
科研交流群
商业服务