官方服务:
资源简介:
Source: Paul the Apostle
应用场景:
相关数据集
sk-community/romanized_hindi
Romanized Hindi数据集是一个包含印地语文本及其罗马化(拉丁脚本)表示的集合。该数据集通过结合多个来源创建,包括开放数据集、合成数据生成和基于规则的转写方法。数据集设计用于训练和评估印地语↔罗马语转写模型。
Hugging Face2025-10-04 更新130
General Utterances Speech Datasets in Hindi
Audio dataset includes General Utterences, featuring Hindi speakers from India
kaggle2026-04-18 更新90
Papers of Ernst Leumann (549): "Śīlānka"
"Śīlānka" C.1.: "Śīlānka's Comm. zum Viśeshāvaśyaka-bhāshya"; c. 2: "Uebersetzung von Viśesh.-ṭīkā V 646 - soweit exerpirt"; c. 3-5 untitled. - Various notes on the Viśeṣāvaśyaka-bhāṣy
DataCite Commons2024-09-14 更新60
SayantanJoker/audio_hindi_karya_tts_description_31
该数据集包含文本、音频文件特征和相关描述信息,具体包括文本内容、文件名、音高均值、音高标准差、信噪比、c50、语速、音素、stoi、si-sdr、pesq、噪声类型、混响程度、言语单调性、噪声的sdr值、语音质量的pesq评分以及文本描述等。数据集分为训练集,包含9977个示例,数据大小为3952879字节。
Hugging Face2025-03-29 更新110
SayantanJoker/google_audio_tts_hindi
该数据集包含了音频文件及其对应的转录文本,适用于音频处理和语音识别相关的任务。数据集仅包含训练集部分,共有2769个音频转录对。
Hugging Face2025-04-03 更新80



