登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Familiarity and idea evaluation
Familiarity and idea evaluation
收藏
Figshare
2022-09-20 更新
2026-04-08 收录
偏见评估
想法评价研究
数据链接:
https://figshare.com/articles/dataset/Familiarity_and_idea_evaluation/21162430/1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Dataset for <strong>Does familiarity with an idea bias its evaluation?</strong>
应用场景:
提供机构:
Schweisfurth, Tim
创建时间:
2022-09-20
相关数据集
Elfsong/BBQ
偏见评估
问答系统
--- dataset_info: features: - name: category dtype: string - name: example_id dtype: int64 - name: question_index dtype: int64 - name: question_polarity dtype: string - nam
Hugging Face
2024-06-09 更新
74
0
McBE
自然语言处理
偏见评估
McBE是一个针对大型语言模型(LLM)的中文偏见评估基准,支持多任务评估,包括文本生成、文本分类、表格问题回答和标记分类等任务。它为研究人员和开发者提供了系统性地测量LLM在中华文化背景下偏见的工具,并能够从多个视角评估模型公平性。
Hugging Face
2025-06-09 更新
37
0
basqbbq
自然语言处理
偏见评估
BasqBBQ数据集是一个巴斯克语的问答任务偏见评估基准。它包含设计用来测试巴斯克语中多个人口统计维度社会偏见的问答。每个问题都有两个版本:模糊版本(ambig)和消歧版本(disambig)。数据集涵盖8个人口统计类别,包括年龄、种族/民族、残疾状况、性别认同、外貌、社会经济地位、国籍和性取向。每个类别都有两种配置,分别对应模糊和消歧问题。数据集分为测试集和训练集,用于评估和微调。
Hugging Face
2025-05-30 更新
12
0
CLIMB
偏见评估
临床决策
CLIMB数据集由南加州大学、加州大学洛杉矶分校和加州大学戴维斯分校共同创建,旨在评估大型语言模型在临床决策中的内在和外在偏见。该数据集包含94739条临床诊断数据,来源于MIMIC-IV数据库中的去标识化电子健康记录。数据集的创建过程结合了ICD-10-CM代码和人口统计信息,通过引入新的评估指标AssocMAD来量化模型在不同人口统计群体中的表现差异。CLIMB数据集主要应用于医疗领域的偏见评
arXiv
2024-07-07 更新
57
0
HiTZ/bbq
偏见评估
问题回答
BBQ数据集是一个用于评估英语问答任务中语言模型社会偏见的基准数据集。它包含针对9个人口统计学维度的社会偏见测试问题,每个问题都有模糊和去模糊两种版本。这些维度包括年龄、残疾状况、性别认同、国籍、外貌、种族和民族、宗教、社会经济状况和性取向。数据集分为测试集和训练集,其中测试集是主要的评估数据,训练集包含用于少量样本学习的4个示例(如果可用)。
Hugging Face
2025-05-30 更新
19
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广