natolambert/tulu-v2-sft-mixture-lima

Name: natolambert/tulu-v2-sft-mixture-lima
Creator: natolambert
Published: 2024-07-15 17:58:38
License: 暂无描述

Hugging Face2024-07-15 更新2024-07-22 收录

下载链接：

https://hf-mirror.com/datasets/natolambert/tulu-v2-sft-mixture-lima

下载链接

链接失效反馈

官方服务：

资源简介：

该数据集包含1018个训练样本，每个样本由数据集名称、唯一标识符和消息列表组成。消息列表中的每条消息包含角色（role）和内容（content）两个字段。数据集的总大小为3868113.3560649264字节，下载大小为1649254字节。

The dataset contains 1018 training samples, each consisting of a dataset name, a unique identifier, and a list of messages. Each message in the list includes two fields: role and content. The total size of the dataset is 3868113.3560649264 bytes, and the download size is 1649254 bytes.

提供机构：

natolambert

原始信息汇总

数据集概述

数据集信息

特征:
- dataset: 数据集名称，类型为字符串。
- id: 数据集ID，类型为字符串。
- messages: 消息列表，包含以下字段：
  - role: 角色，类型为字符串。
  - content: 内容，类型为字符串。

数据分割

train:
- num_bytes: 3868113.3560649264 字节
- num_examples: 1018 个样本

数据集大小

download_size: 1649254 字节
dataset_size: 3868113.3560649264 字节

配置

config_name: default
- data_files:
  - split: train
  - path: data/train-*

5,000+

优质数据集

54 个

任务类型

进入经典数据集