Stereotypes-in-LLMs/hiring-analyses-baseline-en
收藏资源简介:
--- dataset_info: features: - name: candidate_id dtype: string - name: job_id dtype: string - name: CV dtype: string - name: Job Description dtype: string - name: Job Position dtype: string - name: lang dtype: string - name: protected_group dtype: string - name: protected_attr dtype: string - name: group_id dtype: string - name: decision dtype: string - name: feedback dtype: string - name: raw_ai_decision dtype: string splits: - name: gender num_bytes: 30225422 num_examples: 9000 - name: marital_status num_bytes: 7592204 num_examples: 2250 - name: military_status num_bytes: 7587716 num_examples: 2250 - name: religion num_bytes: 13583610 num_examples: 4050 - name: name num_bytes: 15130390 num_examples: 4500 - name: age num_bytes: 9012532 num_examples: 2700 download_size: 5553658 dataset_size: 83131874 configs: - config_name: default data_files: - split: gender path: data/gender-* - split: marital_status path: data/marital_status-* - split: military_status path: data/military_status-* - split: religion path: data/religion-* - split: name path: data/name-* - split: age path: data/age-* license: cc-by-4.0 ---
数据集概述
数据特征
- candidate_id: 字符串类型
- job_id: 字符串类型
- CV: 字符串类型
- Job Description: 字符串类型
- Job Position: 字符串类型
- lang: 字符串类型
- protected_group: 字符串类型
- protected_attr: 字符串类型
- group_id: 字符串类型
- decision: 字符串类型
- feedback: 字符串类型
- raw_ai_decision: 字符串类型
数据分割
- gender: 30225422 字节, 9000 个样本
- marital_status: 7592204 字节, 2250 个样本
- military_status: 7587716 字节, 2250 个样本
- religion: 13583610 字节, 4050 个样本
- name: 15130390 字节, 4500 个样本
- age: 9012532 字节, 2700 个样本
数据大小
- 下载大小: 5553658 字节
- 数据集大小: 83131874 字节
配置
- default 配置包含以下数据文件:
- gender: data/gender-*
- marital_status: data/marital_status-*
- military_status: data/military_status-*
- religion: data/religion-*
- name: data/name-*
- age: data/age-*
许可证
- cc-by-4.0



