shenxq/VideoChat2
收藏官方服务:
资源简介:
该数据集包含多个视频训练数据,来源于不同的公开数据集,如BDD100K、ShareGPTVideo、CLEVRER、DiDeMo、EgoQA、Kinetics-710、MovieChat、NExTQA、Panda、TextVR、TGIF、VideoChatGPT和YouCook2。这些数据集可能用于视频文本到文本的任务,具体用途和内容需要进一步从原始数据集的描述中获取。
This dataset includes multiple video training data sourced from various public datasets such as BDD100K, ShareGPTVideo, CLEVRER, DiDeMo, EgoQA, Kinetics-710, MovieChat, NExTQA, Panda, TextVR, TGIF, VideoChatGPT, and YouCook2. These datasets are likely used for video-text-to-text tasks, and specific uses and contents need to be further obtained from the descriptions of the original datasets.
提供机构:
shenxq搜集汇总
数据集介绍

背景与挑战
背景概述
VideoChat2是一个用于视频-文本到文本任务的数据集,包含约66万条样本,每个样本由视频文件和相关对话组成,对话以人类提问和GPT回答的形式呈现,问题基于视频内容设计为多项选择题。该数据集旨在支持视频理解与生成模型的训练,覆盖多种视频场景和复杂问答。
以上内容由遇见数据集搜集并总结生成



