five

Corpus SI100

收藏
SSH Open MarketPlace2024-09-30 更新2024-10-05 收录
下载链接:
https://marketplace.sshopencloud.eu/dataset/Cf2sdK
下载链接
链接失效反馈
官方服务:
资源简介:
The corpus contains read speech of 101 different speakers (50 female, 50 male, 1 unknown). Each speaker has read approx. 100 sentences from either the SZ subcorpus or the CeBit subcorpus. The language is German. The subcorpus SZ contains 544 sentences from newspaper articles ("Sueddeutsche Zeitung"). The subcorpus CeBit contains 483 sentences from newspaper articles about the CeBit 1995. Each subcorpus is divided into 5 parts of approx. 100 utterances each. Every speaker read only one part of one subcorpus (with some exceptions), thus resulting in a total of 10.387 recorded utterances

该语料库包含101位不同说话人的朗读语音(50名女性、50名男性、1名未知性别)。每位说话人朗读了约100个句子,这些句子来自SZ子语料库或CeBit子语料库中的一个。语言为德语。SZ子语料库包含544个来自报纸文章(《南德意志报》,即“Sueddeutsche Zeitung”)的句子;CeBit子语料库包含483个来自1995年CeBit相关报纸文章的句子。每个子语料库被划分为5个部分,每部分约100个utterance(语音片段)。每位说话人仅朗读一个子语料库中的一个部分(存在少量例外),因此总共得到10,387条录制的utterance。
创建时间:
2024-09-30
5,000+
优质数据集
54 个
任务类型
进入经典数据集
二维码
社区交流群

面向社区/商业的数据集话题

二维码
科研交流群

面向高校/科研机构的开源数据集话题

数据驱动未来

携手共赢发展

商业合作