106年3月花蓮縣土石採取景觀維護特別稅徵績表
收藏ERIC (Education Resources Information Center)
ERIC (Education Resources Information Center) 是一个广泛的教育文献数据库,包含超过130万条记录,涵盖从1966年至今的教育研究、政策和实践。数据集内容包括教育相关的期刊文章、书籍、研究报告、会议论文、技术报告、政策文件等。
eric.ed.gov 收录
THCHS-30
“THCHS30是由清华大学语音与语言技术中心(CSLT)发布的开放式汉语语音数据库。原始录音是2002年在清华大学国家重点实验室的朱晓燕教授的指导下,由王东完成的。清华大学计算机科学系智能与系统,原名“TCMSD”,意思是“清华连续普通话语音数据库”,时隔13年出版,由王东博士发起,并得到了教授的支持。朱小燕。我们希望为语音识别领域的新研究人员提供一个玩具数据库。因此,该数据库对学术用户完全免费。整个软件包包含建立中文语音识别所需的全套语音和语言资源系统。”
OpenDataLab 收录
PCLT20K
PCLT20K数据集是由湖南大学等机构创建的一个大规模PET-CT肺癌肿瘤分割数据集,包含来自605名患者的21,930对PET-CT图像,所有图像都带有高质量的像素级肿瘤区域标注。该数据集旨在促进医学图像分割研究,特别是在PET-CT图像中肺癌肿瘤的分割任务。
arXiv 收录
航空发动机叶片异常检测数据集 (AeBAD)
航空发动机叶片异常检测数据集(AeBAD)由西安交通大学机械工程学院创建,包含两个子数据集:单叶片数据集(AeBAD-S)和叶片视频异常检测数据集(AeBAD-V)。AeBAD-S包含不同尺度的单叶片图像,样本未对齐,存在训练集与测试集间的域转移问题,主要由光照和视角变化引起。AeBAD-V包含安装在航空发动机上的叶片视频,用于检测叶片在旋转过程中的异常。该数据集旨在解决实际工业应用中叶片异常检测的问题,强调同一数据类别内的域多样性。
arXiv 收录
cifar10
该数据集包含了完整的CIFAR10数据集,通过PyTorch下载并分割成.png格式的32x32图片。数据集分为三个部分:训练集(train,49,000个样本)、校准集(calibration,1,000个样本)和测试集(test,10,000个样本),每个部分按类别平衡。
huggingface 收录
