遇见数据集

CMD(Condensed Movies Dataset)

收藏
OpenXLab2026-04-18 收录
官方服务:

资源简介:

一个大规模的视频数据集,包含带有详细字幕的电影片段。超过 3,000 部来自各种类型、国家和几十年的不同电影。带有语义字幕的电影关键场景片段。每部电影浓缩成大约 20 分钟的镜头,提供高效的视频故事。来自尖端人脸检测和跟踪模型的近 50 万个人脸轨迹。使用面部识别从人脸轨迹中识别出 8K 个字符。电影提供的字幕以及 YouTube 的自动生成的字幕。

提供机构:
OpenDataLab
创建时间:
2022-08-10
二维码
社区交流群
二维码
科研交流群
商业服务