Facestar
收藏OpenXLab2026-04-18 收录
官方服务:
资源简介:
Facestar数据集旨在在大规模和高质量的环境中进行视听建模研究。核心数据集功能: 10小时的高质量视听语音数据音频记录在安静的环境中,分辨率为1300x1600的视频,每秒60帧,一个女性和一个男性说话者自然语音: 所有数据都是视频会议设置中的会话语音全脸可见性: 扬声器在说话时对着镜头
提供机构:
OpenDataLab创建时间:
2023-02-13

Facestar数据集旨在在大规模和高质量的环境中进行视听建模研究。核心数据集功能: 10小时的高质量视听语音数据音频记录在安静的环境中,分辨率为1300x1600的视频,每秒60帧,一个女性和一个男性说话者自然语音: 所有数据都是视频会议设置中的会话语音全脸可见性: 扬声器在说话时对着镜头