登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Multimodal Virtual Character Action Dataset
Multimodal Virtual Character Action Dataset
收藏
kaggle
2025-05-14 更新
2025-06-07 收录
虚拟角色
多模态交互
数据链接:
https://www.kaggle.com/datasets/programmer3/multimodal-virtual-character-action-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Audio, Motion & Facial Data
音频(Audio)、动作(Motion)与面部数据(Facial Data)
应用场景:
创建时间:
2025-05-14
相关数据集
Emotiontalk
情感分析
多模态交互
EmotionTalk是一个互动式的中文多模态情感数据集,包含丰富的标注信息。该数据集从19位参与者在对话环境中的互动中收集了声学、视觉和文本三种模态的信息,共计23.6小时的语音(19,250个发言),包括7种情感类别的标注(快乐、惊讶、悲伤、厌恶、愤怒、恐惧和中立),5维情感标签(负面、微负面、中立、微正面和正面),以及4维语音字幕(说话者、说话风格、情感和总体)。数据集以CC BY-NC-S
Hugging Face
2025-07-28 更新
456
0
OmniMMI
多模态交互
视频理解
OmniMMI是一个专为Omni语言模型设计的全面的多模态交互基准,适用于流媒体视频环境。该数据集包含超过1,121个视频和2,290个问题,旨在解决现有视频基准中未被充分探索的两个关键挑战:流媒体视频理解和主动推理。数据集涵盖了六种不同的子任务,包含动作预测、动态状态定位、多轮依赖推理等。数据来源于YouTube和开源视频音频数据,经过人工审核和标注,适用于评估多模态语言模型在流媒体视频环境中的
arXiv
2025-03-29 更新
73
0
omniact
多模态交互
自主代理
Dataset for [OmniACT: A Dataset and Benchmark for Enabling Multimodal Generalist Autonomous Agents for Desktop and Web](https://arxiv.org/abs/2402.17
魔搭社区
2026-07-13 更新
36
0
UR-FUNNY
情感分析
多模态交互
用于理解用于表达幽默的多模态语言。
OpenDataLab
2026-07-12 更新
338
1
mEBAL
多模态交互
电生理信号检测
我们介绍了mEBAL,这是一个用于眨眼检测和注意力水平估计的多模态数据库。mEBAL是一个数据库,最初在arXiv技术报告中介绍,然后被第22届ACM多模式相互作用国际会议接受。 眨眼频率与认知活动有关,已经提出了眨眼的自动检测器,用于许多任务,包括注意力水平估计,神经退行性疾病分析,欺骗识别,驾驶乏力检测或面部反欺骗。但是,该领域中的大多数现有数据库和算法仅限于仅涉及数百个样本和单个传感器 (例
OpenDataLab
2026-07-12 更新
52
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广