neulab/PangeaBench-xm100
收藏资源简介:
--- language: - ar - bn - cs - da - de - el - en - es - fa - fi - fil - fr - hi - hr - hu - id - it - he - ja - ko - mi - nl - 'no' - pl - pt - quz - ro - ru - sv - sw - te - th - tr - uk - vi - zh license: cc-by-4.0 size_categories: - 1K<n<10K task_categories: - image-to-text pretty_name: xm100 dataset_info: features: - name: image_id dtype: string - name: image_locale dtype: string - name: caption dtype: string - name: image dtype: image splits: - name: ar num_examples: 100 - name: bn num_examples: 100 - name: cs num_examples: 100 - name: da num_examples: 100 - name: de num_examples: 100 - name: el num_examples: 100 - name: en num_examples: 100 - name: es num_examples: 100 - name: fa num_examples: 100 - name: fi num_examples: 100 - name: fil num_examples: 100 - name: fr num_examples: 100 - name: hi num_examples: 100 - name: hr num_examples: 100 - name: hu num_examples: 100 - name: id num_examples: 100 - name: it num_examples: 100 - name: he num_examples: 100 - name: ja num_examples: 100 - name: ko num_examples: 100 - name: mi num_examples: 100 - name: nl num_examples: 100 - name: 'no' num_examples: 100 - name: pl num_examples: 100 - name: pt num_examples: 100 - name: quz num_examples: 100 - name: ro num_examples: 100 - name: ru num_examples: 100 - name: sv num_examples: 100 - name: sw num_examples: 100 - name: te num_examples: 100 - name: th num_examples: 100 - name: tr num_examples: 100 - name: uk num_examples: 100 - name: vi num_examples: 100 - name: zh num_examples: 100 configs: - config_name: default data_files: - split: ar path: data/ar-* - split: bn path: data/bn-* - split: cs path: data/cs-* - split: da path: data/da-* - split: de path: data/de-* - split: el path: data/el-* - split: en path: data/en-* - split: es path: data/es-* - split: fa path: data/fa-* - split: fi path: data/fi-* - split: fil path: data/fil-* - split: fr path: data/fr-* - split: hi path: data/hi-* - split: hr path: data/hr-* - split: hu path: data/hu-* - split: id path: data/id-* - split: it path: data/it-* - split: he path: data/he-* - split: ja path: data/ja-* - split: ko path: data/ko-* - split: mi path: data/mi-* - split: nl path: data/nl-* - split: 'no' path: data/no-* - split: pl path: data/pl-* - split: pt path: data/pt-* - split: quz path: data/quz-* - split: ro path: data/ro-* - split: ru path: data/ru-* - split: sv path: data/sv-* - split: sw path: data/sw-* - split: te path: data/te-* - split: th path: data/th-* - split: tr path: data/tr-* - split: uk path: data/uk-* - split: vi path: data/vi-* - split: zh path: data/zh-* --- # XM100 ### This is a copy from https://google.github.io/crossmodal-3600/ If you use this dataset, please cite the original authors: ```bibtex @inproceedings{ThapliyalCrossmodal2022, author = {Ashish Thapliyal and Jordi Pont-Tuset and Xi Chen and Radu Soricut}, title = {{Crossmodal-3600: A Massively Multilingual Multimodal Evaluation Dataset}}, booktitle = {EMNLP}, year = {2022} } ```
## 数据集基本信息 ### 支持语言: 阿拉伯语(ar)、孟加拉语(bn)、捷克语(cs)、丹麦语(da)、德语(de)、希腊语(el)、英语(en)、西班牙语(es)、波斯语(fa)、芬兰语(fi)、他加禄语(fil)、法语(fr)、印地语(hi)、克罗地亚语(hr)、匈牙利语(hu)、印度尼西亚语(id)、意大利语(it)、希伯来语(he)、日语(ja)、韩语(ko)、毛利语(mi)、荷兰语(nl)、挪威语(no)、波兰语(pl)、葡萄牙语(pt)、克丘亚语(quz)、罗马尼亚语(ro)、俄语(ru)、瑞典语(sv)、斯瓦希里语(sw)、泰卢固语(te)、泰语(th)、土耳其语(tr)、乌克兰语(uk)、越南语(vi)、中文(zh) ### 许可协议:cc-by-4.0 ### 样本规模分类:1K<n<10K(即1000 < 样本数量 < 10000) ### 任务类别:图像到文本(image-to-text) ### 展示名称:xm100 ## 数据集详情 ### 数据集特征项: 1. `image_id`:图像唯一标识,字符串类型 2. `image_locale`:图像对应语言标识,字符串类型 3. `caption`:图像文本描述,字符串类型 4. `image`:原始图像数据,图像类型 ### 数据划分: 共包含37个语言专属划分集,每个划分集均包含100条样本,具体划分如下: ar(阿拉伯语)、bn(孟加拉语)、cs(捷克语)、da(丹麦语)、de(德语)、el(希腊语)、en(英语)、es(西班牙语)、fa(波斯语)、fi(芬兰语)、fil(他加禄语)、fr(法语)、hi(印地语)、hr(克罗地亚语)、hu(匈牙利语)、id(印度尼西亚语)、it(意大利语)、he(希伯来语)、ja(日语)、ko(韩语)、mi(毛利语)、nl(荷兰语)、no(挪威语)、pl(波兰语)、pt(葡萄牙语)、quz(克丘亚语)、ro(罗马尼亚语)、ru(俄语)、sv(瑞典语)、sw(斯瓦希里语)、te(泰卢固语)、th(泰语)、tr(土耳其语)、uk(乌克兰语)、vi(越南语)、zh(中文) ### 配置信息: 默认配置(default)下的数据文件与各语言划分集一一对应,数据文件路径格式为`data/[语言代码]-*`,例如ar划分集对应`data/ar-*`,其余语言划分集路径依次类推。 --- # XM100 本数据集复刻自 https://google.github.io/crossmodal-3600/ 若您使用本数据集,请引用原作者的研究: bibtex @inproceedings{ThapliyalCrossmodal2022, author = {Ashish Thapliyal and Jordi Pont-Tuset and Xi Chen and Radu Soricut}, title = {{Crossmodal-3600: A Massively Multilingual Multimodal Evaluation Dataset}}, booktitle = {EMNLP}, year = {2022} }



