MentorVerse-Teacher-Mode-Dataset
收藏资源简介:
该数据集是一个对话格式的数据集,专门用于训练和评估对话生成模型。数据以结构化格式组织,核心特征为messages字段,包含一系列对话消息,每个消息由role(如用户、助手)和content(对话内容文本)组成。数据集规模为299个训练样本,总数据量约4.67MB,适用于自然语言处理任务,包括对话系统开发、聊天机器人训练、指令遵循模型微调以及对话相关的机器学习研究。数据以标准化格式存储,便于直接加载到各种深度学习框架中使用。
This dataset is a dialogue format dataset specifically designed for training and evaluating dialogue generation models. The data is organized in a structured format, with the core feature being the messages field, which contains a series of dialogue messages. Each message entry consists of two key attributes: role (such as user or assistant) and content (the text of the dialogue). The dataset scale includes 299 training samples, with a total data volume of approximately 4.67MB. This structure makes it suitable for natural language processing tasks, particularly dialogue system development, chatbot training, instruction-following model fine-tuning, and dialogue-related machine learning research. The data is stored in a standardized format, facilitating direct loading and use in various deep learning frameworks.
数据集概述:MentorVerse-Teacher-Mode-Dataset
数据集地址:https://huggingface.co/datasets/pranav-model/MentorVerse-Teacher-Mode-Dataset
该数据集是一个面向教师模式的多轮对话数据集,包含 299 条训练样本。
数据结构
每个样本包含一个 messages 字段,该字段是一个列表,列表中的每个元素包含两个属性:
- role:字符串类型,表示对话角色。
- content:字符串类型,表示对应角色的对话内容。
数据集划分
- 训练集(train):共 299 个样本,总字节数为 4,671,765 字节。
数据集大小
- 下载大小:2,134,092 字节(约 2.1 MB)
- 数据集总大小:4,671,765 字节(约 4.7 MB)
配置文件
该数据集只有一个默认配置文件 default,训练数据文件位于 data/train-* 路径下。




