登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
BackpropBuff/LinguaTools-WikiTitles.en-es
BackpropBuff/LinguaTools-WikiTitles.en-es
收藏
Hugging Face
2024-09-07 更新
2024-12-14 收录
多语言信息检索
双语语料对齐
数据链接:
https://hf-mirror.com/datasets/BackpropBuff/LinguaTools-WikiTitles.en-es
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
应用场景:
提供机构:
BackpropBuff
相关数据集
mMARCO
多语言信息检索
深度学习评估
mMARCO是一个多语言版本的MS MARCO段落排序数据集,由坎皮纳斯大学神经网络实验室创建,包含13种语言。该数据集通过机器翻译创建,旨在解决非英语语言在信息检索任务中训练资源稀缺的问题。数据集包含超过53万条查询-段落相关对,适用于训练和评估深度学习模型。mMARCO的创建不仅丰富了多语言信息检索的训练资源,还通过零样本学习场景的评估,展示了其对提升模型效果的潜力。
arXiv
2022-08-18 更新
106
0
lemon-mint/mr-tydi-ko-all-prefixed
多语言信息检索
稠密检索训练
该数据集包含三个主要特征:anchor、positive和negative,每个特征的数据类型均为字符串。数据集仅包含一个训练集,共有131,700个样本,总大小为191,988,250字节。下载大小为52,482,755字节。数据集的配置名为default,数据文件路径为data/train-*。
Hugging Face
2024-07-02 更新
10
0
BackpropBuff/JParaCrawl.en-ja
--- license: mit ---
Hugging Face
2024-09-06 更新
9
0
ravithejads/ms_marco_hi_mr_te
多语言信息检索
问答系统
--- dataset_info: features: - name: answers sequence: string - name: passages sequence: - name: is_selected dtype: int32 - name: passage_text dtype: string - name
Hugging Face
2024-03-24 更新
20
0
The CLEF-IP 2009 Test Collection
专利检索
多语言信息检索
CLEF-IP: Cross-Language Evaluation Forum - Intellectual Property The CLEF-IP track was launched in 2009 to investigate IR techniques for patent retrieval and it is part of the CLEF 2009 evaluation cam
DataCite Commons
2024-08-27 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广