登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
LMMS-SP ALBERT-XXLARGE
LMMS-SP ALBERT-XXLARGE
收藏
Figshare
2023-01-30 更新
2026-04-28 收录
词义消歧
语义向量表示
数据链接:
https://figshare.com/articles/dataset/LMMS-SP_ALBERT-XXLARGE/21975773
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Includes SP-USM and SP-WSD variants, at sensekey and synset level, and SVD-300d version.
应用场景:
创建时间:
2023-01-30
相关数据集
WiC
自然语言处理
词义消歧
WiC数据集是由剑桥大学等机构创建,专注于评估上下文敏感词义表示的大型数据集。该数据集包含7428个实例,每个实例包含一个目标词及其在两个不同上下文中的使用情况,旨在通过二元分类任务评估模型对词义动态变化的理解能力。数据集内容来源于WordNet、VerbNet和Wiktionary等权威资源,经过专家精心注释和筛选,确保数据质量。WiC数据集的应用领域广泛,主要用于评估和改进自然语言处理中词义消
arXiv
2019-04-27 更新
97
0
lopentu/Chinese-Wordnet-SemCor
词义消歧
中文词网
这是一个用于中文词语词义消歧任务的数据集,特别关注于中文词网(CWN)2.0中具有超过10个意义的“困难”词语。数据集包含训练集和测试集,每个数据实例包含目标词语、词性、正确和候选的意义ID及其定义和例句,以及一个标签指示候选意义是否正确。数据来源于中文词网和 Academia Sinica Balanced Corpus,并由六位具有语言学背景的母语汉语使用者进行手动标注。
Hugging Face
2025-05-05 更新
23
0
Senseval-2
自然语言处理
词义消歧
该数据集因尺寸限制,是在Senseval和SemEval情境中使用最小的数据集进行训练。由于内存和时间限制,本研究在训练模型时采用了这一数据集,而没有使用更大的数据集。该数据集的任务是词义消歧。
arXiv
6
0
SBU-WSD-Corpus
自然语言处理
词义消歧
SBU-WSD-Corpus 是波斯语词义消歧 (WSD) 的语料库。它使用来自波斯 WordNet (FarsNet) 感官清单的感官进行手动注释。 SBU-WSD-Corpus 由 19 个波斯语文档组成,包括 Sports、Science、Arts 等不同领域。它包括 5892 个波斯语跑步文本的实词和 3371 个人工感知注释词(2073 个名词、566 个动词、610 个形容词和 122
OpenDataLab
2026-07-12 更新
32
0
deshanksuman/Multilingual_WSD_semcor
多语言处理
词义消歧
这是一个用于词语 sense 离散化(WSD)任务的数据集,包含了多种语言(法语、德语、意大利语、西班牙语)的语料。数据集大小介于10K到100K之间,是mwsd-datasets的意义映射版本,仅供研究使用。
Hugging Face
2025-10-28 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广