Concept Drift Datasets v1.0|概念漂移数据集|数据集数据集
收藏数据集概述
模拟数据集
- 数据分布展示:包括三种类型的概念漂移模拟:
- (a) LAbrupt
- (b) LSudden_3
- (c) LGradual
- (a) NLAbrupt
- (b) NLSudden
- (c) NLGradual
基准数据集
- HYP_05:来自scikit-multiflow,通过HyperplaneGenerator生成,包含1000000个样本。
- SEA_a:来自MOA,通过ConceptDriftStream和SEAGenerator生成,包含1000000个样本。
真实世界数据集(蛟龙)
- 数据集详情请参考:JiaolongDSMS_datasets
概念漂移数据集 v1.0
- 背景:数据集用于测试和评估概念漂移检测算法的性能,包含已知的漂移类型和时间点。
- 使用方法:
- 直接下载数据集并使用pandas库导入。
- 使用DatasetsInput.py或DataStreamGenerator.py进行数据集的生成和导入。
数据集介绍
- Linear:决策边界为直线,通过旋转直线模拟决策边界的改变。
- CakeRotation:通过旋转圆盘模拟概念漂移,奇数和偶数角区域分别属于不同类别。
- ChocolateRotation:通过旋转巧克力板模拟概念漂移,奇数和偶数x+y区域分别属于不同类别。
- RollingTorus:通过滚动第三个圆环模拟概念漂移,不同圆环上的样本属于不同类别。
哈佛概念漂移数据集
- 包含20个多样化的合成数据集,分为10个突变型和10个渐变型,具有不同的特征数量和噪声。
数据集使用示例
使用pandas导入数据集
python import pandas as pd data = pd.read_csv(xxxxxx/nonlinear_gradual_chocolaterotation_noise_and_redunce.csv) data = data.values X = data[:, 0 : 5] Y = data[:, 5]
使用DatasetsInput.py导入数据集
python from DatasetsInput import Datasets Data = Datasets() X, Y = Data.CNNS_Nonlinear_Gradual_ChocolateRotation()
使用DataStreamGenerator.py生成并导入数据集
python from DataStreamGenerator import DataStreamGenerator C = DataStreamGenerator(class_count=2, attribute_count=2, sample_count=100000, noise=True, redunce_variable=True) X, Y = C.Nonlinear_Sudden_RollingTorus(plot=True, save=True)

Figshare
Figshare是一个在线数据共享平台,允许研究人员上传和共享各种类型的研究成果,包括数据集、论文、图像、视频等。它旨在促进科学研究的开放性和可重复性。
figshare.com 收录
UIEB, U45, LSUI
本仓库提供了水下图像增强方法和数据集的实现,包括UIEB、U45和LSUI等数据集,用于支持水下图像增强的研究和开发。
github 收录
LEVIR-CD
LEVIR-CD 是一个新的大规模遥感建筑变化检测数据集。引入的数据集将成为评估变化检测 (CD) 算法的新基准,尤其是基于深度学习的算法。 LEVIR-CD 由 637 个非常高分辨率(VHR,0.5m/像素)Google Earth (GE) 图像块对组成,大小为 1024 × 1024 像素。这些时间跨度为 5 到 14 年的双时相图像具有显着的土地利用变化,尤其是建筑增长。 LEVIR-CD涵盖别墅住宅、高层公寓、小型车库和大型仓库等各类建筑。在这里,我们关注与建筑相关的变化,包括建筑增长(从土壤/草地/硬化地面或在建建筑到新建筑区域的变化)和建筑衰退。这些双时相图像由遥感图像解释专家使用二进制标签(1 表示变化,0 表示不变)进行注释。我们数据集中的每个样本都由一个注释器进行注释,然后由另一个注释器进行双重检查以产生高质量的注释。完整注释的 LEVIR-CD 总共包含 31,333 个单独的变更构建实例。
OpenDataLab 收录
GME Data
关于2021年GameStop股票活动的数据,包括每日合并的GME短期成交量数据、每日失败交付数据、可借股数、期权链数据以及不同时间框架的开盘/最高/最低/收盘/成交量条形图。
github 收录
UAVDT
UAVDT是一个用于目标检测任务的数据集。
github 收录