遇见数据集

thomasavare/italian-dataset-deepl2

收藏
Hugging Face2024-04-25 更新2024-03-04 收录
官方服务:

资源简介:

该数据集包含英语和意大利语的文本数据,每个样本包括英语文本、意大利语文本、类别和类别索引。数据集的训练集包含500个样本,文件大小为60782字节。许可证为cc-by-nc-nd-4.0,支持的语言为英语和意大利语。

提供机构:
thomasavare
原始信息汇总

数据集概述

配置

  • 配置名称: default
  • 数据文件:
    • 分割: train
    • 路径: data/train-*

数据集信息

  • 特征:
    • 名称: english
      • 数据类型: string
    • 名称: italian
      • 数据类型: string
    • 名称: Class
      • 数据类型: string
    • 名称: Class_index
      • 数据类型: float64
  • 分割:
    • 名称: train
      • 字节数: 60782
      • 样本数: 500
  • 下载大小: 22544
  • 数据集大小: 60782
  • 许可证: cc-by-nc-nd-4.0
  • 语言:
    • en
    • it
二维码
社区交流群
二维码
科研交流群
商业服务