Coral tekst-til-tale datasæt
收藏资源简介:
Datasættet består af oplæsninger fra to professionelle danske talere, en kvinde og en mand, som har indlæst cirka 24 timers dansk tale hver. Datasættet er en del af CoRal-projektet (Danish Conversational and Read-aloud Speech Dataset), som er et bredt samarbejdsprojekt mellem Alexandra Instituttet, Datalogisk institut ved Københavns Universitet (DIKU), Alvenir og Cort. CoRal er finansieret og støttet af Digitaliseringsstyrelsen og Den Danske Innovationsfond. Tekstdata er udvalgt af Alexandra Instituttet og består af sætninger fra lex.dk, sundhed.dk, borger.dk, navne på busstoppesteder og stationer, manuelt filtrerede Reddit-kommentarer samt datoer og tidspunkter. Lyddata er optaget af den offentlige institution Nota, som er en del af Kulturministeriet.



