相关数据集
ChatterBot Language Training Corpus
这些模块用于快速训练ChatterBot以响应不同语言的各种输入。尽管ChatterBot设计为语言无关,但拥有这些训练集对于初始化新数据库和使机器人能够产生的响应更加多样化仍然很有用。所有训练数据都是用户贡献的。
github2020-05-14 更新310
rmsdud/chat
该数据集包含对话数据,主要特征为context(上下文)和response(响应),均为字符串类型。数据集包含一个训练集,共有23263个样本,总大小为3753161字节。数据集的下载大小为1554612字节。
Hugging Face2024-12-05 更新100
dustinwloring1988/chat-datasets
该数据集包含两个主要字段:question_prompt(问题提示)和assistant_response(助手响应),均为字符串类型。数据集分为一个训练集,包含202,691个示例,总大小为292,883,616字节。下载大小为117,706,881字节。数据集配置为默认配置,数据文件路径为data/train-*。
Hugging Face2024-07-20 更新70
llm-values/exp_tri_5_3_Qwen__Qwen1.5_32B_Chat_answers
该数据集包含多个特征字段,包括prompt ID、语言、主题、原始提示、翻译提示以及不同版本的Qwen/Qwen1.5-32B-Chat模型的回答。数据集被分割为exp_tri_5_3_Qwen__Qwen1.5_32B_Chat_answers,包含701个示例,总大小为5378044字节。
Hugging Face2024-05-05 更新180
Isaak-Carter/JOSIE_Wizard_Vicuna_unfiltered_with_greetings_70k_v3
--- dataset_info: features: - name: sample dtype: string splits: - name: train num_bytes: 458440925 num_examples: 153908 download_size: 211543673 dataset_size: 458440925 config
Hugging Face2024-02-20 更新90



