官方服务:
资源简介:
50.000 synsets, XML
应用场景:
相关数据集
SBU-WSD-Corpus
SBU-WSD-Corpus 是波斯语词义消歧 (WSD) 的语料库。它使用来自波斯 WordNet (FarsNet) 感官清单的感官进行手动注释。 SBU-WSD-Corpus 由 19 个波斯语文档组成,包括 Sports、Science、Arts 等不同领域。它包括 5892 个波斯语跑步文本的实词和 3371 个人工感知注释词(2073 个名词、566 个动词、610 个形容词和 122
OpenDataLab2026-07-12 更新320
deshanksuman/Multilingual_WSD_semcor
这是一个用于词语 sense 离散化(WSD)任务的数据集,包含了多种语言(法语、德语、意大利语、西班牙语)的语料。数据集大小介于10K到100K之间,是mwsd-datasets的意义映射版本,仅供研究使用。
Hugging Face2025-10-28 更新80
Senseval-2
该数据集因尺寸限制,是在Senseval和SemEval情境中使用最小的数据集进行训练。由于内存和时间限制,本研究在训练模型时采用了这一数据集,而没有使用更大的数据集。该数据集的任务是词义消歧。
arXiv60
lopentu/Chinese-Wordnet-SemCor
这是一个用于中文词语词义消歧任务的数据集,特别关注于中文词网(CWN)2.0中具有超过10个意义的“困难”词语。数据集包含训练集和测试集,每个数据实例包含目标词语、词性、正确和候选的意义ID及其定义和例句,以及一个标签指示候选意义是否正确。数据来源于中文词网和 Academia Sinica Balanced Corpus,并由六位具有语言学背景的母语汉语使用者进行手动标注。
Hugging Face2025-05-05 更新230
Coarse-Grained Sense Inventories Based on Semantic Matching between English Dictionaries
Abstract (our paper) WordNet is one of the largest handcrafted concept dictionaries visualizing word connections through semantic relationships. It is widely used as a word sense inventory in natural
NIAID Data Ecosystem60



