MuCo-VQA
收藏官方服务:
资源简介:
MuCo-VQA 由多种语言的大规模 (3.7M) 多语言和代码混合 VQA 数据集组成:印地语 (hi)、孟加拉语 (bn)、西班牙语 (es)、德语 (de)、法语 (fr) 和 code-混合语言对:en-hi、en-bn、en-fr、en-de 和 en-es。
MuCo-VQA is a large-scale (3.7M) multilingual and code-mixed Visual Question Answering (VQA) dataset. It covers six individual languages: Hindi (hi), Bengali (bn), Spanish (es), German (de), and French (fr), alongside five code-mixed language pairs: en-hi, en-bn, en-fr, en-de and en-es.
提供机构:
OpenDataLab创建时间:
2022-06-07
搜集汇总
数据集介绍

背景与挑战
背景概述
MuCo-VQA是一个大规模多语言和代码混合视觉问答数据集,涵盖印地语、孟加拉语、西班牙语、德语、法语及其与英语的混合对,总样本量达370万。该数据集由印度理工学院巴特那分校于2021年发布,用于促进多语言视觉问答系统的研究。
以上内容由遇见数据集搜集并总结生成



