登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Magpie-Pro-DPO-200K-JSONL
Magpie-Pro-DPO-200K-JSONL
收藏
Opencsg
2025-01-24 更新
2025-05-03 收录
语言模型对齐
直接偏好优化
数据链接:
https://www.opencsg.com/datasets/AIWizards/Magpie-Pro-DPO-200K-JSONL
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该仓库提供了一系列自然语言处理能力,支持文本分类等任务。它提供了标准化数据操作和统一模型接口,方便用户使用。该仓库采用 Apache-2.0 授权许可。
应用场景:
创建时间:
2024-07-19
相关数据集
nlee-208/persona_zero-janus-dpo-7b
语言模型对齐
对话生成
该数据集包含四个特征:人物设定(persona)、提示(prompt)、描述(description)和生成内容(generated)。数据集仅包含一个训练集,共有500个样本,总大小为1612198字节,下载大小为889811字节。数据集的配置文件指定了默认配置,数据文件路径为data/train-*。
Hugging Face
2024-12-13 更新
20
0
jihuny/llama_mag_10k_sky_dpo_newton_g07_l1e2_soft
大语言模型偏好对齐
直接偏好优化
--- dataset_info: features: - name: prompt dtype: string - name: chosen dtype: string - name: rejected dtype: string - name: score_chosen dtype: float64 - name: score_rejec
Hugging Face
2026-03-25 更新
9
0
zjhhhh/generation_for_iter2_7b_multi_gap_0.17
语言模型对齐
生成式对抗训练
--- dataset_info: features: - name: prompt dtype: string - name: requirements dtype: string - name: selection_response_1 dtype: string - name: selection_response_2 dtype: str
Hugging Face
2025-12-19 更新
5
0
trl-internal-testing/tiny-ultrafeedback-binarized
语言模型对齐
奖励模型训练
--- dataset_info: features: - name: chosen list: - name: content dtype: string - name: role dtype: string - name: rejected list: - name: content dtype: stri
Hugging Face
2024-10-17 更新
10
0
sgp-bench/open-instruct-gpt4o_10k
指令微调
语言模型对齐
--- dataset_info: features: - name: instruction dtype: string - name: input dtype: string - name: output dtype: string splits: - name: train num_bytes: 91712519 num_exa
Hugging Face
2024-08-20 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广