登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
VGG-Sound
VGG-Sound
收藏
kaggle
2021-01-10 更新
2024-03-08 收录
音视频对应
多媒体分析
数据链接:
https://www.kaggle.com/datasets/codebreaker619/vggsound
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Audio-Visual Correspondent Dataset
音视觉对应数据集(Audio-Visual Correspondent Dataset)
应用场景:
创建时间:
2021-01-10
相关数据集
jovianzm/Pexels-400k
多媒体分析
机器学习
包含400,476个视频的数据集,每个视频配有缩略图、观看次数、明确内容分类和字幕。
Hugging Face
2024-03-05 更新
124
0
nimapourjafar/mm_geomverse
多模态数据
多媒体分析
--- dataset_info: features: - name: images sequence: image: decode: false - name: audios sequence: 'null' - name: videos sequence: 'null' - name: data list:
Hugging Face
2024-06-14 更新
29
0
global-optima-research/AVSpeech
音频-视觉处理
多媒体分析
包含31164个来自AVSpeech测试集的视频数据集,这些视频从YouTube上下载。
Hugging Face
2025-06-16 更新
22
0
M2VD
多模态视频处理
多媒体分析
多模态多场景视频数据集
github
2025-03-05 更新
92
0
MRSAudio
音频处理
多媒体分析
MRSAudio是一个大规模的多模态录音空间音频数据集,包含同步的双耳和全景声音频、外向和主观视频、运动轨迹以及详细的语义注释。这个数据集分为四个子集,分别是MRSLife、MRSSpeech、MRSSing和MRSMusic,它们分别针对日常活动、演讲、歌唱和音乐等不同场景,支持空间音频的检测、定位、生成等研究。
Hugging Face
2025-05-16 更新
25
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广