遇见数据集

stolzenp/500-cola-sentences-baseline

收藏
Hugging Face2024-05-07 更新2024-06-12 收录
官方服务:

资源简介:

--- dataset_info: features: - name: text dtype: string - name: label dtype: string splits: - name: train num_bytes: 55814 num_examples: 500 download_size: 20077 dataset_size: 55814 configs: - config_name: default data_files: - split: train path: data/train-* --- # Dataset Card for "500-cola-sentences-baseline" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)

提供机构:
stolzenp
原始信息汇总

数据集概述

数据集名称

500-cola-sentences-baseline

数据集特征

  • text:文本类型,数据类型为字符串。
  • label:标签类型,数据类型为字符串。

数据集分割

  • train:训练集,包含500个示例,总大小为55814字节。

数据集大小

  • 下载大小:20077字节
  • 数据集总大小:55814字节

配置信息

  • config_name:default
  • data_files
    • split:train
    • path:data/train-*
搜集汇总
数据集介绍
stolzenp/500-cola-sentences-baseline 数据集图片
背景与挑战
背景概述
该数据集包含500个句子及其语言可接受性标签(label),用于训练和评估语言模型在语法判断任务上的性能。数据集规模小,仅包含训练集,适合作为快速基线测试或原型开发。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务