相关数据集
sapienzanlp/nounatlas_srl_corpus
NounAtlas SRL Corpus数据集是NounAtlas项目的一部分,旨在通过提供组织成语义一致框架的名词谓词的综合清单来增强名词性语义角色标注(SRL)。数据集包含训练、开发和测试三个子集,分别包含22,452、2,806和2,806个句子。示例条目展示了句子的谓词、角色、词干和单词的标注情况。注释过程包括将WordNet名词同义词集映射到VerbAtlas框架、生成包含名词谓词的句子
Hugging Face2024-07-22 更新720
lingvenvist/animacy-bg-gold-standard-minus
该数据集包含句子、词元、动画标签和目标索引等字段。动画标签字段包含三个类标签:N、A和H。数据集被分为训练集、测试集和验证集,分别包含13955、2990和2991个示例。
Hugging Face2024-07-14 更新120
AnCora_西班牙语多层面标注语料库数据3_0_1
本数据集为AnCora 3.0.1西班牙语语料库,包含约50万字的新闻文本,覆盖词元、词性、句法成分、论元结构、动词语义类、名物化隐含论元等多层面标注,支持自然语言处理相关研究与应用。 AnCora-corpus
海数据80
Chinese Proposition Bank 1.0
Introduction Chinese Proposition Bank 1.0 was produced by Linguistic Data Consortium (LDC) catalog number LDC2005T23 and ISBN 1-58563-354-2. Chinese Proposition Bank 1.0 is the firs
DataCite Commons2021-07-01 更新160
autoevaluate/autoeval-eval-futin__feed-sen_vi_-0f1239-2245871648
--- type: predictions tags: - autotrain - evaluation datasets: - futin/feed eval_info: task: text_zero_shot_classification model: bigscience/bloom-3b metrics: [] dataset_name: futin/feed dat
Hugging Face2022-11-26 更新100



