遇见数据集

ining310/gigaspeech-10hr

收藏
Hugging Face2025-10-11 更新2025-10-25 收录
官方服务:

资源简介:

GigaSpeech Translation en-zh Pair Dataset (IndexTTS2)是一个包含英文和中文翻译的语音段对的数据集,用于语音到语音的翻译任务。数据集包含8410对语音段,每个语音段都有对应的英文和中文翻译。数据集提供了详细的元数据信息,包括每个语音段的路径和对应的参考文本。

GigaSpeech Translation en-zh Pair Dataset (IndexTTS2) is a dataset containing pairs of English and Chinese translated speech segments for speech-to-speech translation tasks. The dataset includes 8,410 pairs of speech segments, each with corresponding English and Chinese translations. The dataset provides detailed metadata information, including the path to each speech segment and the aligned reference transcript text.

提供机构:
ining310
二维码
社区交流群
二维码
科研交流群
商业服务