遇见数据集

Ganesh01kumar02reddy/medical-reasoning-processed_phi4_sft

收藏
Hugging Face2026-05-03 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含三个子集:step1_quality_filtered(质量过滤后的数据)、step3_length_filtered(长度过滤后的数据)和step4_split(分割后的训练集和验证集)。每个样本包含用户内容(user_content)、助手内容(assistant_content)和推理内容(reasoning_content)。数据集主要用于训练多轮对话模型,尤其是涉及推理过程的对话场景。

This dataset contains three subsets: step1_quality_filtered (data after quality filtering), step3_length_filtered (data after length filtering), and step4_split (split into training and validation sets). Each sample includes user_content, assistant_content, and reasoning_content. The dataset is primarily used for training multi-turn dialogue models, especially those involving reasoning processes.

提供机构:
Ganesh01kumar02reddy
二维码
社区交流群
二维码
科研交流群
商业服务