惠州市仲恺高新区恺企通融资信息核查信息|融资信息核查数据集|公共服务数据集
收藏AIS数据集
该研究使用了多个公开的AIS数据集,这些数据集经过过滤、清理和统计分析。数据集涵盖了多种类型的船舶,并提供了关于船舶位置、速度和航向的关键信息。数据集包括来自19,185艘船舶的AIS消息,总计约6.4亿条记录。
github 收录
GenshinVoice
GenshinVoice是一个包含原神游戏中所有语音文件及其对应文字文本的数据集。数据集直接从游戏中提取,包含多种语言版本,用于学习和研究目的。
github 收录
O*NET
O*NET(Occupational Information Network)是一个综合性的职业信息数据库,提供了关于各种职业的详细描述,包括技能要求、工作活动、知识领域、工作环境等。该数据集被广泛用于职业分析、教育和劳动力市场研究。
www.onetonline.org 收录
THCHS-30
“THCHS30是由清华大学语音与语言技术中心(CSLT)发布的开放式汉语语音数据库。原始录音是2002年在清华大学国家重点实验室的朱晓燕教授的指导下,由王东完成的。清华大学计算机科学系智能与系统,原名“TCMSD”,意思是“清华连续普通话语音数据库”,时隔13年出版,由王东博士发起,并得到了教授的支持。朱小燕。我们希望为语音识别领域的新研究人员提供一个玩具数据库。因此,该数据库对学术用户完全免费。整个软件包包含建立中文语音识别所需的全套语音和语言资源系统。”
OpenDataLab 收录
航空发动机叶片异常检测数据集 (AeBAD)
航空发动机叶片异常检测数据集(AeBAD)由西安交通大学机械工程学院创建,包含两个子数据集:单叶片数据集(AeBAD-S)和叶片视频异常检测数据集(AeBAD-V)。AeBAD-S包含不同尺度的单叶片图像,样本未对齐,存在训练集与测试集间的域转移问题,主要由光照和视角变化引起。AeBAD-V包含安装在航空发动机上的叶片视频,用于检测叶片在旋转过程中的异常。该数据集旨在解决实际工业应用中叶片异常检测的问题,强调同一数据类别内的域多样性。
arXiv 收录
