遇见数据集

arbml/Dangerous_Dataset

收藏
Hugging Face2024-07-19 更新2024-03-04 收录
官方服务:

资源简介:

该数据集包含推文文本及其对应的标签,标签分为两类:safe(安全)和dangerous(危险)。数据集包含一个训练集,共有5009个样本,总大小为590535字节。

The dataset consists of tweet texts and their corresponding safety labels, which are categorized into safe and dangerous. It includes only a training set with 5009 examples, totaling 590535 bytes in size.

提供机构:
arbml
原始信息汇总

数据集概述

数据特征

  • Tweet: 类型为字符串。
  • label: 类型为类别标签,包含两个类别:
    • 0: 安全
    • 1: 危险

数据分割

  • train:
    • 字节数: 590535
    • 样本数: 5009

数据集大小

  • 下载大小: 300264 字节
  • 数据集大小: 590535 字节

配置

  • default:
    • 数据文件路径: data/train-*
二维码
社区交流群
二维码
科研交流群
商业服务