遇见数据集

Gretel Synthetic Safety Alignment Dataset

收藏
官方服务:

资源简介:

A comprehensive dataset designed for aligning language models with safety and ethical guidelines. Contains 8,361 curated triplets of prompts, responses, and safe responses across various risk categories. Each entry includes safety scores, judge reasoning, and harm probability assessments, making it valuable for model alignment, testing, and benchmarking.

本数据集为面向语言模型安全与伦理准则对齐任务构建的综合性数据集,包含8361条经精心筛选的提示词(prompt)、模型回复与安全回复三元组,覆盖各类风险类别。每条数据均包含安全评分、评判推理过程与伤害概率评估,可用于模型对齐、模型测试与基准评测,具备较高的应用价值。

提供机构:
Gretel.ai
二维码
社区交流群
二维码
科研交流群
商业服务