遇见数据集

Audio Visual Database for Speech Disfluency

收藏
Figshare2024-04-02 更新2026-04-08 收录
官方服务:

资源简介:

This is a database for Multimodal Speech Disfluency. The Fluency Bank dataset comprises stuttering event annotations for 34 video podcasts, containing approximately 4000 audio and video clips, each lasting 3 seconds. Audio and Video files are part of this dataset and full episodes can also be downloaded using url in fluencybank_episodes.csv.

本数据集为多模态言语流利障碍(Multimodal Speech Disfluency)研究领域专用数据库。Fluency Bank数据集包含34个视频播客的口吃事件标注,共计约4000段单段时长为3秒的音视频片段。本数据集附带音视频文件,用户可通过fluencybank_episodes.csv中提供的链接下载完整播客剧集。

提供机构:
Likhite, Shamika
创建时间:
2024-04-02
二维码
社区交流群
二维码
科研交流群
商业服务