登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
toxic cache
toxic cache
收藏
kaggle
2019-06-19 更新
2024-03-11 收录
文本预处理
有害内容识别
数据链接:
https://www.kaggle.com/datasets/ceshine/toxic-cache
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Tokenized training data to save time
经Token化处理的训练数据,用于节省时间
应用场景:
创建时间:
2019-06-13
相关数据集
DangerousQA
有害内容识别
语言模型安全评估
该数据集包含了200个有毒问题,覆盖了包括种族歧视、刻板印象、性别歧视和非法内容等不同有害类别。此外,该数据集旨在评估语言模型对于有毒和有害问题的回应,规模为200个问题,任务是对语言模型的安全性进行评估。
arXiv
36
0
Toxic_comments_challenge_DSBA
文本分类
有害内容识别
Unbiased toxic comments classification task.
kaggle
2024-01-03 更新
14
0
systemk/toxic-open2ch
有害内容识别
社交媒体分析
--- dataset_info: features: - name: speaker sequence: int8 - name: content sequence: string - name: is_safe dtype: bool - name: cat dtype: string splits: - name: train
Hugging Face
2024-06-06 更新
13
0
AdamMeme
多模态语言模型
有害内容识别
AdamMeme是一个动态评估框架,用于评估多模态大型语言模型(mLLMs)在辨别有害表情包方面的推理能力。该框架通过多代理协作,不断更新表情包数据集,以揭示mLLMs在理解有害性方面的具体局限性。该数据集旨在帮助研究人员评估和改进mLLMs在表情包有害性理解方面的能力,以促进在线安全的应用。
arXiv
2025-07-02 更新
24
0
Pre-processing steps.
文本预处理
邻接网络
Example of pre-processing steps performed in a extract for the purpose of creating a adjacency network. The pre-processing step eliminates punctuation marks and words conveying low semantic content. T
NIAID Data Ecosystem
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广