MELD Preprocessed
收藏官方服务:
资源简介:
Multi-modal dataset designed for emotion recognition (text, audio, vision)
专为情感识别任务设计的多模态数据集(Multi-modal dataset),涵盖文本、音频、视觉三种模态
创建时间:
2025-03-01
搜集汇总
数据集介绍

背景与挑战
背景概述
MELD Preprocessed是一个多模态情感识别数据集,包含从对话视频中提取的文本、音频和视觉数据,并已进行标准化预处理。数据集以PyTorch友好的.pt文件格式存储,包含清洗后的文本、音频波形、Mel频谱图和人脸图像等特征,适用于情感识别和多模态融合研究。
以上内容由遇见数据集搜集并总结生成



