数据链接:
官方服务:
资源简介:
Bin4 image from M2EA experiment for example purposes in spam
应用场景:
创建时间:
2024-07-18
相关数据集
Nemotron-Content-Safety-Audio-Dataset
Nemotron内容安全音频数据集是一个多模态扩展的[Nemotron内容安全数据集V2(Aegis 2.0)](https://huggingface.co/datasets/nvidia/Aegis-AI-Content-Safety-Dataset-2.0),包含从测试集提示中生成的**1,928个音频文件**。该数据集通过提供23个违规类别中对抗性和安全关键性提示的语音版本,使多模态AI安
Hugging Face2025-12-02 更新240
lilacai/mosaicml-local-mosaic-instruct-v3
This dataset is generated by [Lilac](http://lilacml.com) for a HuggingFace Space: [huggingface.co/spaces/lilacai/mosaicml](https://huggingface.co/spaces/lilacai/mosaicml). Original dataset: [https://
Hugging Face2023-08-30 更新140
synthetic-guardrail-dataset-v1
Tanaos_guardrail_v1训练数据集是一个由Tanaos使用Artifex Python库合成的数据集,旨在训练和评估用于检测、分类或过滤不安全、有害或违反政策的文本内容的守门系统。该数据集包含标记为“安全”或“不安全”的文本样本,其中“不安全”类别包括诸如亵渎、暴力、性内容、骚扰、隐私泄露和上下文控制问题等内容。该数据集用于训练、微调和评估充当AI系统守门员的模型,常见用例包括检测和
Hugging Face2025-11-14 更新80
mapo-t2i/pick-safety
该数据集名为Pick-Safety,是使用Stable Diffusion XL自建的。通过上下文提示(即没有风格规范),生成(1)带有风格前缀提示的卡通风格生成和(2)带有上下文提示的正常生成。然后,(1)被用作选择的图像,(2)被用作拒绝的图像。选择的字段包含SDXL的正常生成,而拒绝的字段包含使用SDXL生成的有害和不安全的图像。
Hugging Face2024-06-11 更新200
中国移动互联网治理行业文本数据合成数据集
本数据集由合成中文文本和合成英文文本组成,重点体现模型生成内容、规则驱动文本与仿真文本在语义、格式和风格上的可控性。样本可用于增强语料规模、提升模型对生成内容的识别能力,并支持对抗测试、鲁棒性评估及内容安全检测中的数据补齐。
国家数据集管理服务平台2026-05-28 更新120



