数据链接:
官方服务:
资源简介:
No description provided.
应用场景:
创建时间:
2023-10-08
相关数据集
大模型内容安全文本数据集
“大模型内容安全文本数据集”,包含各种可能违规、不当或有害内容,如恶意攻击、人身攻击、歧视言论、色情、暴力等语料,可用于大模型的内容安全训练学习和评测。1)作为训练集,可提升大模型对各类负面指令的识别和回答能力,更加安全可靠、最大程度地防止模型产生有害输出;2)作为测试集,用于大模型的内容安全测试,评估大模型在针对各类负面指令时是否具有拒识或按照正确的价值观来回答问题的能力,确保大模型输出的内容符
北京市数据知识产权2024-06-20 更新4591
nemotron-nano2-safety-distill-gptoss
Nemotron Nano 2 安全精简数据集,使用Nemotron Nano 2配方和GPT-OSS-20B及GPT-OSS-120B作为教师模型创建。由于资源限制,生成的推理步骤和响应没有经过守门模型的过滤。该数据集包含大约35,000个示例,可能会在未来版本中增加。数据来源于Nemotron内容安全数据集V2、gretel-v1、HarmfulTasks和RedTeam2K。
Hugging Face2025-10-22 更新250
lilacai/mosaicml-local-mosaic-instruct-v3
This dataset is generated by [Lilac](http://lilacml.com) for a HuggingFace Space: [huggingface.co/spaces/lilacai/mosaicml](https://huggingface.co/spaces/lilacai/mosaicml). Original dataset: [https://
Hugging Face2023-08-30 更新140
蜜度安巡通
蜜度安巡通基于大数据、自然语言处理、知识图谱等技术,实现对文字标点差错、知识性差错、内容导向风险等内容的精准识别,通过新媒体检查、网站检查、属地巡查等功能快速定位问题,帮助用户快速进行内容的自查自纠、整改优化、风险防范,有效保障网站、新媒体、客户端的内容安全,为政府、媒体和企业提供全栈式内容安全管理解决方案。
西部数据交易中心2023-05-06 更新520
mapo-t2i/pick-safety
该数据集名为Pick-Safety,是使用Stable Diffusion XL自建的。通过上下文提示(即没有风格规范),生成(1)带有风格前缀提示的卡通风格生成和(2)带有上下文提示的正常生成。然后,(1)被用作选择的图像,(2)被用作拒绝的图像。选择的字段包含SDXL的正常生成,而拒绝的字段包含使用SDXL生成的有害和不安全的图像。
Hugging Face2024-06-11 更新200



