Actinobacillus porcitonsillarum|微生物学数据集|细菌研究数据集
收藏THCHS-30
“THCHS30是由清华大学语音与语言技术中心(CSLT)发布的开放式汉语语音数据库。原始录音是2002年在清华大学国家重点实验室的朱晓燕教授的指导下,由王东完成的。清华大学计算机科学系智能与系统,原名“TCMSD”,意思是“清华连续普通话语音数据库”,时隔13年出版,由王东博士发起,并得到了教授的支持。朱小燕。我们希望为语音识别领域的新研究人员提供一个玩具数据库。因此,该数据库对学术用户完全免费。整个软件包包含建立中文语音识别所需的全套语音和语言资源系统。”
OpenDataLab 收录
中国近海台风路径集合数据集(1945-2024)
1945-2024年度,中国近海台风路径数据集,包含每个台风的真实路径信息、台风强度、气压、中心风速、移动速度、移动方向。 数据源为获取温州台风网(http://www.wztf121.com/)的真实观测路径数据,经过处理整合后形成文件,如使用csv文件需使用文本编辑器打开浏览,否则会出现乱码,如要使用excel查看数据,请使用xlsx的格式。
国家海洋科学数据中心 收录
鸣潮角色TTS数据集
鸣潮角色语音数据集是基于Bert-vits2开源项目制作的,包含了鸣潮游戏1.0至1.3版本的中、日、英、韩全角色语音。它提供了单角色包和完整包以满足不同用户的需求,每个语音文件都有对应的文本标注,方便进行语音识别和训练。数据集中的语音按类别整理,包括战斗语音、带变量语音等,分类清晰,便于查找和使用。用户可以在ModelScope平台直接下载数据集,无需登录。此数据集仅供个人欣赏和学习交流使用,不得用于商业用途或非法活动。鸣潮角色语音数据集旨在支持AI语音合成和识别技术的研究与开发,为用户提供了一个丰富的多角色、多语种的语音资源库。
魔搭社区 收录
Chest X-ray Images (Pneumonia)
该项目使用的数据集来自Kaggle,包含两类胸部X光图像:正常和肺炎。数据集分为训练集和测试集,用于训练和评估深度学习模型,以检测肺炎。
github 收录
中国省级灾害统计空间分布数据集(1999-2020年)
该数据集为中国省级灾害统计空间分布数据集,时间为1999-2020年。该数据集包含中国各省自然灾害、地质灾害、地震灾害、森林火灾、森林病虫鼠害、草原灾害六类灾害的详细数据。数据量为206MB,数据格式为excel。
国家地球系统科学数据中心 收录
