jihuny/tldr-preference
收藏官方服务:
资源简介:
TL;DR偏好数据集是一个用于RM/DPO风格偏好训练的镜像数据集,基于OpenAI的summarize-from-feedback公开发布数据,并经过CleanRL预处理。它保留了原始的分割名称、列、标记化字段和行顺序,适用于TL;DR脚本训练。
The TL;DR Preference Dataset is a mirrored dataset for RM/PO-style preference training, based on the OpenAI summarize-from-feedback public release and preprocessed by CleanRL. It retains the original split names, columns, tokenized fields, and row order for use with local TL;DR scripts.
提供机构:
jihuny


