agentlans/grammar-classification
收藏官方服务:
资源简介:
Grammar Classification Dataset数据集是一个基于C4语料库的子集,包含60万个用于英语语法正确性二分类的示例。数据集分为训练集和验证集,每个条目包括输入文本和表示语法正确性的二进制标签。
The Grammar Classification Dataset is a subset derived from the C4 (Colossal Clean Crawled Corpus), containing 600,000 examples for binary classification of grammatical correctness in English. It is split into a training set and a validation set, with each entry including an input text and a binary label indicating grammatical correctness.
提供机构:
agentlans


