taocode/MSDWild
收藏官方服务:
资源简介:
MSDWild数据集旨在测试以下任务中的多模态分析:多模态说话人分离、多模态说话人定位和音视频唇同步。数据集仅用于研究目的,为了提高研究的可重复性,上传了`video.zip`文件,这些视频仅供研究使用,且可能根据原始视频所有者的请求随时移除。
The MSDWild dataset aims to test multimodal analysis across the following tasks: multimodal speaker separation, multimodal speaker localization, and audio-visual lip synchronization. This dataset is intended solely for research purposes. To improve the reproducibility of research, the `video.zip` file has been uploaded. These videos are for research use only and may be removed at any time upon the request of the original video owners.
提供机构:
taocode原始信息汇总
MSDWild 数据集概述
数据集名称
- MSDWild
数据集用途
- 用于测试多模态分析,具体任务包括:
- 多模态说话人日志
- 多模态说话人定位
- 视听唇同步
数据集许可
- 许可名称:cc
- 许可版本:cc-by-4.0
- 许可文件链接:LICENSE
数据集使用限制
- 数据库仅限于研究目的使用。
- 提供的视频文件(
video.zip)仅供研究使用,其他用途严格禁止。 - 所有使用必须遵守许可协议。
- 材料可能随时因原视频所有者的请求而被移除。
搜集汇总
数据集介绍

背景与挑战
背景概述
MSDWild数据集专注于多模态分析,支持多模态说话人日志、定位和音视频唇同步任务,仅供研究使用,并提供了视频文件以确保可复现性。
以上内容由遇见数据集搜集并总结生成



