遇见数据集

taocode/MSDWild

收藏
Hugging Face2024-04-29 更新2024-06-12 收录
官方服务:

资源简介:

MSDWild数据集旨在测试以下任务中的多模态分析:多模态说话人分离、多模态说话人定位和音视频唇同步。数据集仅用于研究目的,为了提高研究的可重复性,上传了`video.zip`文件,这些视频仅供研究使用,且可能根据原始视频所有者的请求随时移除。

The MSDWild dataset aims to test multimodal analysis across the following tasks: multimodal speaker separation, multimodal speaker localization, and audio-visual lip synchronization. This dataset is intended solely for research purposes. To improve the reproducibility of research, the `video.zip` file has been uploaded. These videos are for research use only and may be removed at any time upon the request of the original video owners.

提供机构:
taocode
原始信息汇总

MSDWild 数据集概述

数据集名称

  • MSDWild

数据集用途

  • 用于测试多模态分析,具体任务包括:
    • 多模态说话人日志
    • 多模态说话人定位
    • 视听唇同步

数据集许可

  • 许可名称:cc
  • 许可版本:cc-by-4.0
  • 许可文件链接:LICENSE

数据集使用限制

  • 数据库仅限于研究目的使用。
  • 提供的视频文件(video.zip)仅供研究使用,其他用途严格禁止。
  • 所有使用必须遵守许可协议。
  • 材料可能随时因原视频所有者的请求而被移除。
搜集汇总
数据集介绍
taocode/MSDWild 数据集图片
背景与挑战
背景概述
MSDWild数据集专注于多模态分析,支持多模态说话人日志、定位和音视频唇同步任务,仅供研究使用,并提供了视频文件以确保可复现性。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务