Fine-Grained Human Feedback Gives Better Rewards for Language Model Training
收藏数据链接:
官方服务:
资源简介:
QA-Feedback used in the paper: Fine-Grained Human Feedback Gives Better Rewards for Language Model Training
创建时间:
2023-06-05

QA-Feedback used in the paper: Fine-Grained Human Feedback Gives Better Rewards for Language Model Training