TrainingDataPro/hispanic-kyc-photo-dataset
收藏资源简介:
Know Your Customer数据集专注于西班牙裔人群的面部检测和再识别,包含超过10,800张照片,其中1,400多张为文档照片,涉及720多人来自19个国家。数据集包含多种文档类型,如护照、驾驶执照等,并提供个人照片,包括2张证件照和13张自拍照。所有个人信息均已隐藏。此数据集适用于面部识别、情感检测、年龄估计和性别分类等多种图像处理任务。
许可证:CC-BY-NC-ND-4.0 任务类别: - 图像分类 - 图像分割 - 图像到图像转换 - 图像特征提取 - 特征提取 - 目标检测 语言: - 英语 - 西班牙语 标签: - 法律领域 - 金融领域 - 代码相关 # 了解你的客户(Know Your Customer,简称KYC)数据集:人脸检测与重识别,西班牙裔人群 包含全族裔人群的同类数据集:[证件照与自拍数据集](https://trainingdata.pro/datasets/document-photos-and-selfies?utm_source=huggingface&utm_medium=cpc&utm_campaign=hispanic-kyc) 本数据集包含10800余张图像,其中包括来自19个国家的720余名人物的1400余张证件照。每位人物对应2张证件照与13张自拍图像。本数据集内所有人物均为西班牙裔,涵盖了不同背景与年龄段的个体。 **注:证件照仅保留人物面部图像,证件上的所有个人信息均已隐去**  ### 数据集中包含的证件类型 - 护照 - 国际护照 - 驾驶证 - 学生证 - 健康证明 - 退休证 - 工作通行证 - 其他证件 本数据集可应用于多种任务,包括**人脸识别、情绪检测、年龄估计、性别分类**,以及其他与人体图像分析相关的任务。 # 💴 商业使用说明:完整版数据集包含10800余张人物图像,可前往**[TrainingData平台](https://trainingdata.pro/datasets/hispanic-people-kyc-photo?utm_source=huggingface&utm_medium=cpc&utm_campaign=hispanic-kyc)**提交申请以购买完整版数据集。 ### 完整版数据集元数据说明 - **assignment_id**:媒体文件的唯一标识符 - **worker_id**:人物的唯一标识符 - **age**:人物年龄 - **gender**:人物性别 - **country**:人物所属国家 - **ethnicity**:人物族裔 - **photo_1_extension、photo_2_extension……photo_15_extension**:数据集中各照片的文件扩展名 - **photo_1_resolution、photo_2_resolution……photo_15_resolution**:数据集中各照片的分辨率 ### 数据集统计信息  # 💴 数据集购买说明:本页面仅展示数据集示例,如需了解价格并购买完整版数据集,请前往**[TrainingData平台数据集页面](https://trainingdata.pro/datasets/hispanic-people-kyc-photo?utm_source=huggingface&utm_medium=cpc&utm_campaign=hispanic-kyc)**提交申请。 # 数据集内容构成 本数据集包含以下内容: - **文件目录**:包含5个对应单个人物的文件夹,每个文件夹内包含15张图像(2张证件照与13张自拍) - **.csv元数据文件**:包含数据集中所有图像与人物的相关信息 ### CSV格式元数据文件说明 - **id**:人物唯一标识 - **age**:人物年龄 - **gender**:人物性别 - **country**:人物所属国家 - **id_1、id_2**:证件照的访问链接 - **selfie_1、selfie_2……selfie_13**:该人物13张自拍的访问链接 ## **[TrainingData平台](https://trainingdata.pro/datasets/hispanic-people-kyc-photo?utm_source=huggingface&utm_medium=cpc&utm_campaign=hispanic-kyc)**可提供符合您需求的高质量数据标注服务。 TrainingData平台在Kaggle上的更多数据集:**https://www.kaggle.com/trainingdatapro/datasets** TrainingData平台的GitHub仓库:**https://github.com/Trainingdata-datamarket/TrainingData_All_datasets** *关键词:生物识别系统、生物特征数据集、人脸识别数据库、人脸识别数据集、人脸检测数据集、面部分析、目标检测数据集、深度学习数据集、计算机视觉数据集、人体图像数据集、人脸数据集、机器学习、图像到图像转换、重识别、证件照、证件照与自拍配对集、人像、身份验证模型、护照、证件卡图像、数字化身份照片、西班牙裔人群、西班牙裔数据集*
数据集概述
数据集名称
- Know Your Customer Dataset, Face Detection and Re-identification, Hispanic People
数据集内容
- 10,800+ 照片,包括 1,400+ 文档照片,来自 720+ 人,覆盖 19 个国家。
- 每位参与者提供2张文档照片和13张自拍照。
- 所有参与者均为西班牙裔,涵盖不同背景和年龄段。
文档类型
- 护照
- 国际护照
- 驾驶执照
- 学生卡
- 健康证书
- 退休人员身份证
- 工作通行证
- 其他文档
数据集用途
- 人脸识别
- 情感检测
- 年龄估计
- 性别分类
- 其他与人类图像分析相关的问题
数据集结构
- 文件:包含5个文件夹,每个文件夹对应一个人,包含15张图片(2张身份证照片和13张自拍照)。
- .csv文件:包含关于图像和人的信息。
元数据
- assignment_id:媒体文件的唯一标识符
- worker_id:人的唯一标识符
- age:人的年龄
- gender:人的性别
- country:人的国家
- ethnicity:人的种族
- photo_1_extension, ..., photo_15_extension:数据集中照片的扩展名
- photo_1_resolution, ..., photo_15_resolution:数据集中照片的分辨率
统计信息
- 数据集的统计信息未详细说明,但提供了相关的统计图表链接。
许可证
- cc-by-nc-nd-4.0
语言
- en
- es
标签
- legal
- finance
- code
任务类别
- image-classification
- image-segmentation
- image-to-image
- image-feature-extraction
- feature-extraction
- object-detection




