遇见数据集

RM-Bench

收藏
AI_Studio2025-09-08 更新2025-08-23 收录
官方服务:

资源简介:

用于评估奖励模型对内容差异的敏感性和对风格偏见的抵抗力的基准。

A benchmark for evaluating the sensitivity of reward models to content differences and their resistance to style biases.

提供机构:
墨染山河
二维码
社区交流群
二维码
科研交流群
商业服务