登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
UWA Sense Embeddings
UWA Sense Embeddings
收藏
Figshare
2023-01-30 更新
2026-04-28 收录
词义消歧
语义表示学习
数据链接:
https://figshare.com/articles/dataset/UWA_Sense_Embeddings/21977405
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Sense embeddings resulting from different versions of the UWA corpus. Using BERT and RoBERTa.
应用场景:
创建时间:
2023-01-30
相关数据集
SBU-WSD-Corpus
自然语言处理
词义消歧
SBU-WSD-Corpus 是波斯语词义消歧 (WSD) 的语料库。它使用来自波斯 WordNet (FarsNet) 感官清单的感官进行手动注释。 SBU-WSD-Corpus 由 19 个波斯语文档组成,包括 Sports、Science、Arts 等不同领域。它包括 5892 个波斯语跑步文本的实词和 3371 个人工感知注释词(2073 个名词、566 个动词、610 个形容词和 122
OpenDataLab
2026-07-12 更新
22
0
pankajrajdeo/AMBIGLUI_UMLS
医学信息学
词义消歧
AMBIGLUI数据集是UMLS(统一医学语言系统)元数据的一部分,采用Rich Release Format(RRF)格式。该数据集包含关于模糊术语标识符的信息,特别是将词汇唯一标识符(LUI)与多个概念唯一标识符(CUI)链接起来。它有助于在元数据中识别具有多个含义的词汇变体类别。该数据集旨在帮助开发者和研究人员识别和消除具有多个含义的术语,这对于医疗信息学中的精确术语识别、临床决策支持和健康
Hugging Face
2024-07-18 更新
10
0
LMMS-SP XLNET-LARGE-CASED
词义消歧
语义向量表示
Includes SP-USM and SP-WSD variants, at sensekey and synset level, and SVD-300d version.
Figshare
2023-01-30 更新
6
0
carbon225/poleval-abbreviation-disambiguation-wiki
自然语言处理
词义消歧
PolEval 2022 Task 2 Pretraining Dataset是一个用于波兰语缩写消歧的预训练数据集。缩写消歧是将缩写扩展为完整形式的过程,例如将eng.扩展为engineer。在波兰语中,由于创建缩写的多种方式以及额外的变形形式,这一任务更加复杂。该数据集包含用于预训练的数据,适用于损坏文本恢复、基础/变形形式预测和缩写消歧等任务。数据集的字段包括`text`和`labels`,
Hugging Face
2023-07-09 更新
14
0
swap-uniba/EVWSD-ITA-eval
词义消歧
多语言处理
This is the evaluation set for the EVWSD-ITA EVALITA 2026 task. Each instance contains a "query" (manually written following the procedure outlined on the main site) and a list of candidate images (i
Hugging Face
2026-03-27 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广