遇见数据集

WebVid-2M

收藏
OpenDataLab2026-07-12 更新2024-05-09 收录
官方服务:

资源简介:

大型文本-视频数据集,包含从素材网站抓取的1000 万个视频-文本对。该数据集用于大规模预训练,以在我们的冻结时间工作中实现最先进的端到端检索。

Large-scale text-video dataset consisting of 10 million video-text pairs crawled from stock media websites. This dataset is employed for large-scale pre-training to achieve state-of-the-art end-to-end retrieval in our frozen-time work.

提供机构:
OpenDataLab
创建时间:
2023-03-28
搜集汇总
数据集介绍
WebVid-2M 数据集图片
背景与挑战
背景概述
WebVid-2M是一个大型文本-视频数据集,包含从素材网站抓取的1000万个视频-文本对,专为大规模预训练设计,以支持端到端视频检索任务。该数据集由牛津大学和古斯塔夫埃菲尔大学于2021年发布,主要用于计算机视觉和视频理解领域的研究与应用。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务