csebuetnlp/BanglaContextualBias
收藏官方服务:
资源简介:
Bangla Contextual Bias数据集是一个用于孟加拉语偏见检测的数据集,包含WEAT、SEAT、CEAT和Log Probability Bias四个部分。WEAT部分包含约255个独特词汇,SEAT部分包含约1500个独特模板句子,CEAT部分包含约300万条从Bangla2B+数据集中提取的句子,Log Probability Bias部分包含约3600个手工设计的句子。该数据集旨在填补孟加拉语偏见测量基准的空白,支持对孟加拉语语言模型中的偏见进行广泛分析和评估。
Bangla Contextual Bias数据集是一个用于孟加拉语偏见检测的数据集,包含WEAT、SEAT、CEAT和Log Probability Bias四个部分。WEAT部分包含约255个独特词汇,SEAT部分包含约1500个独特模板句子,CEAT部分包含约300万条从Bangla2B+数据集中提取的句子,Log Probability Bias部分包含约3600个手工设计的句子。该数据集旨在填补孟加拉语偏见测量基准的空白,支持对孟加拉语语言模型中的偏见进行广泛分析和评估。
提供机构:
csebuetnlp


