Ants & Flies, USA, 1941|昆虫学数据集|历史摄影数据集
收藏THCHS-30
“THCHS30是由清华大学语音与语言技术中心(CSLT)发布的开放式汉语语音数据库。原始录音是2002年在清华大学国家重点实验室的朱晓燕教授的指导下,由王东完成的。清华大学计算机科学系智能与系统,原名“TCMSD”,意思是“清华连续普通话语音数据库”,时隔13年出版,由王东博士发起,并得到了教授的支持。朱小燕。我们希望为语音识别领域的新研究人员提供一个玩具数据库。因此,该数据库对学术用户完全免费。整个软件包包含建立中文语音识别所需的全套语音和语言资源系统。”
OpenDataLab 收录
LIDC-IDRI
LIDC-IDRI 数据集包含来自四位经验丰富的胸部放射科医师的病变注释。 LIDC-IDRI 包含来自 1010 名肺部患者的 1018 份低剂量肺部 CT。
OpenDataLab 收录
OECD Statistics
OECD Statistics 数据集包含了经济合作与发展组织(OECD)发布的各种统计数据,涵盖了经济、社会、环境、教育、科技等多个领域。数据集提供了详细的指标和时间序列数据,帮助研究人员和政策制定者分析和理解全球经济和社会发展趋势。
stats.oecd.org 收录
AIS数据集
该研究使用了多个公开的AIS数据集,这些数据集经过过滤、清理和统计分析。数据集涵盖了多种类型的船舶,并提供了关于船舶位置、速度和航向的关键信息。数据集包括来自19,185艘船舶的AIS消息,总计约6.4亿条记录。
github 收录
Photovoltaic fault dataset
该数据集包含了一个并网光伏电站16天的运行数据,包括正常和故障状态。数据集分为两个.mat文件,可以使用MATLAB加载。数据涵盖了电压、电流、温度、辐照度和故障类别标签等信息。
github 收录
