登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Word frequencies from the Trinity Speech-Gesture Dataset
Word frequencies from the Trinity Speech-Gesture Dataset
收藏
Figshare
2020-08-05 更新
2026-04-08 收录
多模态交互
语音-手势协同
数据链接:
https://figshare.com/articles/Word_frequencies_from_the_Trinity_Speech-Gesture_Dataset/12764174/1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Frequencies of all the words used in the Trinity Speech-Gesture Dataset
应用场景:
创建时间:
2020-08-05
相关数据集
ObjectFolder 1.0
多模态交互
3D对象处理
OBJECTFOLDER是由斯坦福大学研究人员创建的多模态3D虚拟对象数据集,旨在推动多模态感知与交互研究。该数据集包含100个虚拟化对象,涵盖视觉、听觉和触觉三种模态的隐式神经表示。每个对象通过隐式神经网络建模,可生成不同视角的视觉图像、碰撞声音和表面触觉信息。数据集对象来源于在线资源库,经过精细的视觉纹理处理和物理属性标注。其创建过程结合了神经隐式表示技术,通过深度神经网络编码多模态数据,形成
ai.stanford.edu
2021-11-08 更新
138
1
MCA-Bench
验证码安全
多模态交互
MCA-Bench是一个包含四种模态的端到端CAPTCHA安全基准测试,包括静态视觉识别、点击定位、交互操作和文本逻辑问答,涵盖了20个现实世界中的任务。该数据集提供了超过180000个训练样本和一个包含4000个项目的测试集(每个任务200个示例),分为四个集群,分别评估OCR对视觉噪声的鲁棒性、复杂场景中的目标检索、类似人类的交互行为和多步骤语言推理。数据集样本包括点选定位、静态视觉识别、文本
arXiv
2025-06-06 更新
53
0
SpokenVisIT
多模态交互
语音识别
SpokenVisIT SpokenVisIT is a real-world visual-speech interaction benchmark built upon VisIT-Bench, designed to evaluate the visual-grounded speech interaction capabilities of omni large multimodal m
魔搭社区
2026-04-28 更新
7
0
OmniMMI
多模态交互
视频理解
OmniMMI是一个专为Omni语言模型设计的全面的多模态交互基准,适用于流媒体视频环境。该数据集包含超过1,121个视频和2,290个问题,旨在解决现有视频基准中未被充分探索的两个关键挑战:流媒体视频理解和主动推理。数据集涵盖了六种不同的子任务,包含动作预测、动态状态定位、多轮依赖推理等。数据来源于YouTube和开源视频音频数据,经过人工审核和标注,适用于评估多模态语言模型在流媒体视频环境中的
arXiv
2025-03-29 更新
83
0
穿戴式设备多模态向后挥手手势识别训练数据
穿戴式手势识别
多模态交互
本数据主要应用于人工智能领域中多模态手势识别模型的训练与优化。该数据集由公司基于智能手环等穿戴式设备采集,融合了惯性测量单元(IMU)与表面肌电(sEMG)两种传感器数据,构建了双支路输入结构,覆盖了多种静态与动态手势类型,具备高质量、高多样性和高标注准确性的特点。通过对该数据集的训练,所构建的手势识别模型能够实现对用户手势的精准识别,涵盖日常交互中常见的静态手势(如握拳、张开手掌)与动态手势(如
浙江省数据知识产权登记平台
2026-06-16 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广