Coliphages and gastrointestinal illness in recreational waters: pooled analysis of six coastal beach cohorts
收藏COCA (Corpus of Contemporary American English)
COCA是一个包含超过5.2亿词的英语语料库,涵盖了从1990年至今的文本。它包括口语、小说、流行杂志、报纸和学术文章五种文体,旨在反映当代美国英语的使用情况。
www.english-corpora.org 收录
Electrical-Lines-Defect-Detection
该数据集是针对电力线路缺陷检测的,包含了由APEPDCL线路工人使用移动相机捕获的图片,并由Sampath Balaji团队整理。数据集以CC BY 4.0许可证发布,旨在促进开源合作、可重现性和人工智能的实践学习。数据集分为两个模块:目标检测和分类。目标检测模块遵循YOLOv12格式,分类模块由文件夹和CSV文件组成,都提供了训练、验证和测试数据集。
huggingface 收录
SAVEE
SAVEE(Surrey Audio-Visual Expressed Emotion)数据集包含480个音频和视频文件,由4名男性英语母语者在7种不同的情绪状态下录制。这些情绪包括愤怒、高兴、悲伤、惊讶、恐惧、厌恶和中性。每个文件的时长约为3秒,总时长约为24分钟。该数据集主要用于情感识别研究。
kahlan.eps.surrey.ac.uk 收录
MNIST数据集
数据规模 训练集:60,000 张手写数字图像(28×28 像素灰度图)及对应标签 34。 测试集:10,000 张图像与标签,用于模型评估 68。 数据来源 由美国国家标准与技术研究院(NIST)收集,50% 样本来自高中生手写,50% 来自人口普查局工作人员 48。 经 Yann LeCun 团队标准化处理,成为机器学习基准数据集 1011。
阿里云天池 收录
Salinas
Salinas数据集是一个高光谱遥感图像数据集,包含16个波段,覆盖了加利福尼亚州Salinas山谷的农业区域。该数据集主要用于高光谱图像分类和土地覆盖分析。
www.ehu.eus 收录
