遇见数据集

huggingartists/headie-one

收藏
Hugging Face2022-10-25 更新2024-03-04 收录
官方服务:

资源简介:

该数据集包含从Genius解析的歌词数据,旨在用于生成歌词。数据集大小为0.679898 MB,语言为英语。数据集中包含一个名为text的字段,用于存储歌词文本。数据集的结构包括一个训练集,包含224个样本,并且可以通过代码将训练集进一步划分为训练集、验证集和测试集。

This dataset contains lyric data parsed from Genius, which is specifically designed for lyrics generation. The dataset has a size of 0.679898 MB and uses English as its language. It includes a field named "text" to store the lyric texts. The dataset structure consists of a training set with 224 samples, and the training set can be further split into training, validation, and test subsets via code.

提供机构:
huggingartists
原始信息汇总

数据集概述

数据集名称

  • 名称: huggingartists/headie-one

数据集描述

  • 摘要: 该数据集从Genius解析的歌词数据,旨在用于HuggingArtists生成歌词。
  • 语言: 英语(en)
  • 数据集大小: 0.679898 MB

数据集结构

  • 数据字段:
    • text: 字符串类型,包含歌词文本。
  • 数据分割:
    训练集 验证集 测试集
    224 - -

使用方法

  • 加载数据集: python from datasets import load_dataset dataset = load_dataset("huggingartists/headie-one")

数据集创建

  • 来源数据:
    • 初始数据收集和标准化: 信息待补充。
    • 源语言生产者: 信息待补充。
  • 注释:
    • 注释过程: 信息待补充。
    • 注释者: 信息待补充。

附加信息

  • 数据集管理者: 信息待补充。

  • 许可证信息: 信息待补充。

  • 引用信息:

    @InProceedings{huggingartists, author={Aleksey Korshuk} year=2022 }

二维码
社区交流群
二维码
科研交流群
商业服务