登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
liyinghong/biomedical-qa-dpo-gemini
liyinghong/biomedical-qa-dpo-gemini
收藏
Hugging Face
2024-04-19 更新
2025-11-01 收录
生物医学问答
偏好优化训练
数据链接:
https://hf-mirror.com/datasets/liyinghong/biomedical-qa-dpo-gemini
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
liyinghong
相关数据集
1231czx/7b_gemma_kto_iter2_random_pair
语言模型对齐
偏好优化训练
该数据集包含多个特征,包括gt(字符串类型)、chosen(包含content和role两个字段的列表)、rejected(包含content和role两个字段的列表)以及rej(字符串序列)。数据集分为一个训练集(train),包含13731个样本,文件大小为25564686字节。下载大小为11394523字节。
Hugging Face
2024-07-19 更新
15
0
GENTEL-Lab/TRQA
药物靶点发现
生物医学问答
TRQA是一个评估数据集,用于评估在治疗目标发现领域的生物医学知识和目标识别技能。它包括两个子数据集:TRQA-lit和TRQA-db。TRQA-lit专注于治疗目标相关的研究发现,构建了一个从文献语料库中总结知名治疗目标最新研究进展的问题回答(QA)数据集。TRQA-db则设计用于系统评估现有方法在解决竞争环境调查问题时信息检索、整合和推理的有效性。
Hugging Face
2025-06-03 更新
13
0
jihuny/llama_shp_10k_sky_dpo_mgopt_a15_l1e2
语言模型对齐
偏好优化训练
--- dataset_info: features: - name: prompt dtype: string - name: chosen dtype: string - name: rejected dtype: string - name: score_chosen dtype: float64 - name: score_rejec
Hugging Face
2026-03-21 更新
9
0
iqwiki-kor/dpo-prompts-Qwen2.5-7B-distill-SFT-n1-seed6247
语言模型对齐
偏好优化训练
--- dataset_info: features: - name: prompt dtype: string - name: responses dtype: string splits: - name: train num_bytes: 217752578 num_examples: 66951 download_size: 91826
Hugging Face
2024-10-24 更新
13
0
liyinghong/DFPO-Preft-taiyi
对话模型
强化学习对齐
--- license: mit dataset_info: features: - name: conversation_id dtype: int64 - name: category dtype: string - name: dataset dtype: string - name: language dtype:
Hugging Face
2024-10-23 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广