登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Multilingual lexicon of toponyms
Multilingual lexicon of toponyms
收藏
SSH Open MarketPlace
2023-10-13 更新
2024-08-03 收录
地名词汇
多语言
数据链接:
https://marketplace.sshopencloud.eu/dataset/arAco9
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This is a glossary of toponyms available for download from clarin:el.
应用场景:
创建时间:
2023-10-13
相关数据集
ALM-Bench
多语言
多模态
ALM-Bench是一个多语言多模态的多样化文化基准数据集,涵盖100种语言和19个类别,用于评估下一代LMMs的文化包容性。
github
2024-11-27 更新
33
0
Babelscape/multinerd
实体识别
多语言
MultiNERD数据集是首个语言无关的方法,用于自动创建多语言、多类型和细粒度的命名实体识别(NER)和实体消歧注释。该数据集覆盖10种语言(中文、荷兰语、英语、法语、德语、意大利语、波兰语、葡萄牙语、俄语和西班牙语),15个NER类别(人物、地点、组织、动物、生物实体、天体、疾病、事件、食物、仪器、媒体、植物、神话实体、时间和交通工具),以及2种文本类型(维基百科和维基新闻)。数据集结构包括t
Hugging Face
2023-04-20 更新
22
0
clips/beir-nl-dbpedia-entity
信息检索
多语言
BEIR-NL是一个荷兰语版本的BEIR基准测试,涵盖了从生物医学、金融文本到一般网络内容的各种领域。数据集包含多个任务,如事实核查、问答、生物医学信息检索、论点检索、重复问题检索、引用预测和实体检索。数据集结构包括corpus、queries和qrels文件,分别用于存储文档、查询和查询文档相关性判断。数据集的创建目的是为了促进荷兰语信息检索模型的发展,通过自动翻译BEIR数据集来实现。然而,数
Hugging Face
2025-02-10 更新
15
0
iAkashPaul/limmits-2024
文本到语音
多语言
Indic TTS数据集包含来自IISCs LIMMITS Challenge 2024的7种语言,主要用于训练基于VALLE-X和VoiceBox的TTS模型。数据集涵盖了英语、孟加拉语、印地语、卡纳达语、泰卢固语、马拉地语和恰蒂斯加尔语等多种印度语言。
Hugging Face
2024-04-23 更新
25
0
mekaneeky/Synthetic_English_VITS_22.5k
语音合成
多语言
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: dev path: data/dev-* - split: test path: data/test-* dataset_info: features: - name:
Hugging Face
2023-10-27 更新
20
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广