遇见数据集

MuCo-VQA

收藏
OpenDataLab2026-08-23 更新2024-05-09 收录
官方服务:

资源简介:

MuCo-VQA 由多种语言的大规模 (3.7M) 多语言和代码混合 VQA 数据集组成:印地语 (hi)、孟加拉语 (bn)、西班牙语 (es)、德语 (de)、法语 (fr) 和 code-混合语言对:en-hi、en-bn、en-fr、en-de 和 en-es。

MuCo-VQA is a large-scale (3.7M) multilingual and code-mixed Visual Question Answering (VQA) dataset. It covers six individual languages: Hindi (hi), Bengali (bn), Spanish (es), German (de), and French (fr), alongside five code-mixed language pairs: en-hi, en-bn, en-fr, en-de and en-es.

提供机构:
OpenDataLab
创建时间:
2022-06-07
搜集汇总
数据集介绍
MuCo-VQA 数据集图片
背景与挑战
背景概述
MuCo-VQA是一个大规模多语言和代码混合视觉问答数据集,涵盖印地语、孟加拉语、西班牙语、德语、法语及其与英语的混合对,总样本量达370万。该数据集由印度理工学院巴特那分校于2021年发布,用于促进多语言视觉问答系统的研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务