登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
InternVid
InternVid
收藏
OpenXLab
2026-04-18 收录
视频-文本表示学习
多模态视频生成
数据链接:
https://openxlab.org.cn/datasets/shepshep/InternVid
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
InternVid是一个大规模的以视频为中心的多模态数据集,可用于学习强大且可迁移的视频-文本表示,用于多模态理解和生成。
应用场景:
提供机构:
shepshep
创建时间:
2023-10-25
相关数据集
InternVid全集
多模态学习
视频理解
InternVid是一个大规模的以视频为中心的多模态数据集,可用于学习强大且可迁移的视频-文本表示,用于多模态理解和生成。InternVid数据集包含超过700万个视频,总时长近76万小时,共有2.34亿个视频片段,伴随着总计41亿个单词的详细描述。我们的核心贡献在于开发了一种可扩展的方法,利用语言模型自主构建高质量的视频-文本数据集,并展示了其在大规模学习视频-语言表示方面的有效性。具体而言,我
OpenDataLab
2026-07-12 更新
186
0
AI短剧多模态制作与剧情推演数据
剧本场景结构化
多模态视频生成
本数据集主要应用于AI短剧(以《恶犬之灾》为例,44集共51分钟)从剧本到成片的工业化制作流程,覆盖编剧、AI生成师、剪辑师、运营人员等多角色协同作业。在剧本阶段,通过NER算法自动提取每集的主要人物、核心标签、地理场景及情绪标签,将44集文本快速拆解为标准化场景结构化数据(含场景编号、出场人物及核心动机、人物弧光变化、关键事件链、核心台词、戏剧节拍等23个字段),辅助编剧快速识别每集叙事节奏是否
浙江省数据知识产权登记平台
2026-07-27 更新
22
0
AI短剧多模态制作与剧情推演数据
AI短剧剧情推演
多模态视频生成
本数据集主要应用于AI短剧(以《恶犬之灾》为例,44集共51分钟)从剧本到成片的工业化制作流程,覆盖编剧、AI生成师、剪辑师、运营人员等多角色协同作业。在剧本阶段,通过NER算法自动提取每集的主要人物、核心标签、地理场景及情绪标签,将44集文本快速拆解为标准化场景结构化数据(含场景编号、出场人物及核心动机、人物弧光变化、关键事件链、核心台词、戏剧节拍等23个字段),辅助编剧快速识别每集叙事节奏是否
浙江省数据知识产权登记平台
2026-08-11 更新
6
0
InternVid
多模态学习
视频理解
InternVid是一个大规模的以视频为中心的多模态数据集,可用于学习强大且可迁移的视频-文本表示,用于多模态理解和生成。
OpenDataLab
2026-07-12 更新
33
0
CineDance-1M
影视叙事生成
多模态视频生成
CineDance-1M是由多所顶尖学术机构联合创建的大规模、开源的文本-音频-视频(T2AV)数据集,专门为多镜头、长时长的影视级音视频联合生成而设计。该数据集包含100万条高质量序列,平均时长92.8秒,每段视频包含24.2个连续镜头,以1080p分辨率提供结构化、可配置的双模态标注。其创建过程采用严谨的三阶段流程:首先通过多样化来源与全面清洗确保原始素材质量;其次引入基于电影理论的叙事解析算
arXiv
2026-06-08 更新
22
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广