登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Frame30
Frame30
收藏
kaggle
2024-10-26 更新
2025-01-04 收录
唇语识别
视觉语音分析
数据链接:
https://www.kaggle.com/datasets/ferzhaputrautama/frame30
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Berisi potongan 30 frame kelas kata yang telah diberi lip landmark
包含30帧的类别词汇片段,已标注关键点特征
应用场景:
创建时间:
2024-10-26
相关数据集
LRW
唇语识别
语音识别
LRW(Lip Reading in the Wild)是一个用于唇语识别的数据集,包含500个常用英语单词的视频片段。每个单词有1000个不同的说话者实例,总计500,000个视频片段。数据集主要用于研究唇语识别技术。
www.robots.ox.ac.uk
205
0
GRID Dataset
唇语识别
视频处理
500 该数据集是一个广受欢迎的句子级别的唇语阅读数据集,包含了34位发言人的句子,每个视频时长为3秒钟。在未知的发言人分割中,使用发言人1、2、20和22进行测试,其余的则用于训练。该数据集的规模为34位发言人,每分钟约有20个视频,其任务是对唇语进行识别。
arXiv
97
0
DataoceanAI/Lip_reading_Speech_Video_Corpus
唇语识别
视频分析
该数据集包含250个个体,每个个体录制不少于600个短句,每个个体的有效视频时长为半小时,适用于人脸识别和物体检测等任务。
Hugging Face
2024-07-17 更新
46
0
LRW-1000 (Lip Reading in the Wild - 1000)
唇语识别
自然环境
LRW-1000是一个大规模的唇语识别数据集,包含1000个最常见的英文单词。每个单词有1000个不同的视频样本,每个视频长度为1.16秒。数据集旨在推动唇语识别技术的发展,特别是在自然环境中的应用。
www.robots.ox.ac.uk
186
0
Lip Reading in the Wild (LRW)
唇语识别
机器学习
数据集由多达1000个不同单词的话语组成,由数百个不同的说话者说出。所有视频的长度均为29帧 (1.16秒),并且单词出现在视频的中间。单词持续时间在元数据中给出,您可以从中确定开始帧和结束帧。下表给出了数据集统计数据。
OpenDataLab
2026-07-12 更新
80
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广