登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Race and gender terms, with frequencies in the dataset.
Race and gender terms, with frequencies in the dataset.
收藏
Figshare
2023-01-25 更新
2026-04-28 收录
社会偏见分析
人口统计词汇统计
数据链接:
https://figshare.com/articles/dataset/Race_and_gender_terms_with_frequencies_in_the_dataset_/21955708
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Race and gender terms, with frequencies in the dataset.
应用场景:
创建时间:
2023-01-25
相关数据集
SOFA (Social Fairness)
社会偏见分析
语言模型评估
SOFA数据集是由比萨大学和哥本哈根大学的研究团队开发的一个大型基准资源,旨在深入分析语言模型中的社会偏见。该数据集包含超过110万个条目,覆盖了性别、宗教、残疾和国籍等多个关键社会类别。通过结合来自社会偏见推理语料库(SBIC)的刻板印象和由Czarnowska等人创建的身份词汇,SOFA数据集能够详细探讨语言模型对不同社会身份的潜在偏见。此外,数据集的创建过程涉及对原始数据的精细筛选和标准化处
arXiv
2024-02-20 更新
101
0
荷兰 CrowS-Pairs 数据集
语言模型评估
社会偏见分析
荷兰 CrowS-Pairs 数据集是一个用于测量荷兰语言模型中社会偏见的数据集。该数据集包含 1463 个句子对,涵盖了 9 个类别的偏见,如性取向、性别和残疾。句子对由对比句子组成,其中一个句子涉及弱势群体,另一个句子涉及优势群体。使用荷兰 CrowS-Pairs 数据集,我们发现各种语言模型(BERTje、RobBERT、多语言 BERT、GEITje 和 Mistral-7B)在各种偏见类
arXiv
2025-07-22 更新
24
0
artianand/bbq_roberta_base_race_custom_loss_predictions
自然语言处理
社会偏见分析
该数据集是一个包含多个字段的结构化数据集,主要用于训练机器学习模型。它包含了类别、示例ID、问题索引、问题极性、上下文条件、上下文、问题、三个答案选项、答案信息、答案标签、目标标签以及附加元数据等信息。数据集分为训练集,共有54992个示例,总大小为44065722字节。附加元数据中包含了关于答案对齐、条件、已知刻板印象群体、标签类型、相关社会价值观、来源、刻板印象群体、子类别和版本等信息。
Hugging Face
2025-02-12 更新
11
0
Korean HateSpeech Dataset
仇恨言论检测
社会偏见分析
总共有 9,381 条人工标记的评论。它们分为 7,896 个训练集、471 个验证集和 974 个测试集。 (为了公平比较预测模型,我们未公开测试集标签。该模型可以通过 Kaggle 提交来评估,这将在本文档后面描述。)每条评论都在两个方面进行注释,社会偏见和仇恨言论的存在,鉴于仇恨言论与偏见密切相关。
OpenDataLab
2026-07-12 更新
35
0
anoaky/sbf-collated
文本分类
社会偏见分析
该数据集包含四个不同的配置(intentYN, offensiveYN, sexYN, speakerMinorityYN),每个配置都包含帖子(post)和相应的标签(YN)。数据集分为测试集、验证集和训练集,适用于文本分类和文本生成任务。数据集的语言为英语,规模在10K到100K之间。该数据集是从allenai/social_bias_frames转换而来,并对每个帖子的三个注释者响应进行了平
Hugging Face
2024-12-16 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广