登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Globetrotter
Globetrotter
收藏
OpenXLab
2026-04-18 收录
多语言字幕
跨语言视觉理解
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/Globetrotter
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
我们收集了Globetrotter数据集。它包含来自三个不同字幕数据集的图像的52种不同语言的字幕。
应用场景:
提供机构:
OpenDataLab
创建时间:
2023-02-13
相关数据集
PAQ (Probably Asked Questions)
自然语言处理
机器学习
可能问的问题 (PAQ) 是一个非常大的资源,包含 6500 万个自动生成的 QA 对。 PAQ 是 65M 自然语言 QA 对的半结构化知识库 (KB),模型可以记忆和/或学习从中检索。 PAQ 与传统 KB 的不同之处在于问题和答案以自然语言存储,并且生成的问题很可能出现在 ODQA 数据集中。 PAQ 是使用问题生成模型和维基百科自动构建的。
OpenDataLab
2026-07-12 更新
30
0
Clothing Attributes Dataset
服装属性识别
细粒度分析
我们引入服装属性数据集,以促进学习对象视觉属性的研究。该数据集包含1856个图像,具有26个地面真相服装属性,例如 “长袖”,“有衣领” 和 “条纹图案”。标签是使用Amazon Mechanical Turk收集的。
OpenXLab
8
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
Kinship
家族关系
亲缘识别
该关系数据库由两个家族中的 24 个唯一名称组成(它们具有相同的结构)。
OpenXLab
9
0
NeutrinoPit/OpenSubtitles2024-en-ar-batch15
自然语言处理
多语言字幕
这是一个包含英文和阿拉伯文两种语言数据的数据集,适用于训练语言模型或进行文本分析。数据集分为训练集,共有100万条示例,数据集大小为99820912字节。
Hugging Face
2025-03-04 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广