遇见数据集

thinkPy/synthetic-dataset_cultura-guarani_llama3-70B

收藏
Hugging Face2024-06-17 更新2024-06-29 收录
官方服务:

资源简介:

该数据集包含多个特征,如id、类型、上下文、问题、模型、国家、语言、时期、章节和参考文献。数据集分为一个训练集,包含33082个样本,总大小为88162807字节。下载大小为1621638字节。

The dataset contains multiple features such as id, type, context, questions, model, country, language, period, chapter, and references. The dataset is divided into a training set containing 33082 samples, with a total size of 88162807 bytes. The download size is 1621638 bytes.

提供机构:
thinkPy
原始信息汇总

数据集概述

许可证

  • 许可证类型:cc-by-sa-4.0

数据集信息

特征

  • id: 数据类型为 int64
  • tipo: 数据类型为 string
  • contexto: 数据类型为 string
  • preguntas: 数据类型为 string
  • modelo: 数据类型为 string
  • país: 数据类型为 string
  • idioma: 数据类型为 string
  • periodo: 数据类型为 string
  • capitulo: 数据类型为 string
  • referencias: 数据类型为 string

数据分割

  • train: 包含 33082 个样本,占用 88162807 字节

数据集大小

  • 下载大小:1621638 字节
  • 数据集总大小:88162807 字节

配置

  • default:
    • 数据文件路径:data/train-*
二维码
社区交流群
二维码
科研交流群
商业服务