flow_around_cylinder|流体动力学数据集|机器学习数据集
收藏数据集概述
数据来源
- 数据集源自OpenFOAM模拟,原始数据可从此链接获取。
数据处理
- 在线版本中,额外计算了力和单元中心。
- 数据集可通过解压
data.tgz
文件获取。
数据集操作
- 提供了多种子采样方法,包括比例子采样、随机子采样、全数据集采样等。
- 使用
python subsample_maxent.py
等脚本进行数据子采样,参数如--path
,--target
,-ns
,-nc
等用于指定路径、目标、样本数和聚类数。 - 支持通过
--subsample
参数选择不同的子采样方法,如equal
,random-weighted
等。 - 使用
--dtype
参数指定数据类型,如interpolated
,csv
等。
数据集应用
- 数据集用于机器学习模型的训练和验证,如通过
python train.py
脚本进行神经网络训练。 - 支持时间序列预测,通过设置
--window
参数进行窗口样本的子采样,并使用LSTM架构进行训练。
数据集可视化
- 通过
ffmpeg
命令创建结果视频,用于展示maxent.py
的输出。
注意事项
- 更改特征、目标、窗口或数据类型定义后,需删除
snapshots/raw_data.npz
文件以避免错误或不正确的结果。 - 为复现AI4S论文中的图8结果,需运行特定命令多次并平均结果。

中国区域地面气象要素驱动数据集 v2.0(1951-2024)
中国区域地面气象要素驱动数据集(China Meteorological Forcing Data,以下简称 CMFD)是为支撑中国区域陆面、水文、生态等领域研究而研发的一套高精度、高分辨率、长时间序列数据产品。本页面发布的 CMFD 2.0 包含了近地面气温、气压、比湿、全风速、向下短波辐射通量、向下长波辐射通量、降水率等气象要素,时间分辨率为 3 小时,水平空间分辨率为 0.1°,时间长度为 74 年(1951~2024 年),覆盖了 70°E~140°E,15°N~55°N 空间范围内的陆地区域。CMFD 2.0 融合了欧洲中期天气预报中心 ERA5 再分析数据与气象台站观测数据,并在辐射、降水数据产品中集成了采用人工智能技术制作的 ISCCP-ITP-CNN 和 TPHiPr 数据产品,其数据精度较 CMFD 的上一代产品有显著提升。 CMFD 历经十余年的发展,其间发布了多个重要版本。2019 年发布的 CMFD 1.6 是完全采用传统数据融合技术制作的最后一个 CMFD 版本,而本次发布的 CMFD 2.0 则是 CMFD 转向人工智能技术制作的首个版本。此版本与 1.6 版具有相同的时空分辨率和基础变量集,但在其它诸多方面存在大幅改进。除集成了采用人工智能技术制作的辐射和降水数据外,在制作 CMFD 2.0 的过程中,研发团队尽可能采用单一来源的再分析数据作为输入并引入气象台站迁址信息,显著缓解了 CMFD 1.6 中因多源数据拼接和气象台站迁址而产生的虚假气候突变。同时,CMFD 2.0 数据的时间长度从 CMFD 1.6 的 40 年大幅扩展到了 74 年,并将继续向后延伸。CMFD 2.0 的网格空间范围虽然与 CMFD 1.6 相同,但其有效数据扩展到了中国之外,能够更好地支持跨境区域研究。为方便用户使用,CMFD 2.0 还在基础变量集之外提供了若干衍生变量,包括近地面相对湿度、雨雪分离降水产品等。此外,CMFD 2.0 摒弃了 CMFD 1.6 中通过 scale_factor 和 add_offset 参数将实型数据化为整型数据的压缩技术,转而直接将实型数据压缩存储于 NetCDF4 格式文件中,从而消除了用户使用数据时进行解压换算的困扰。 本数据集原定版本号为 1.7,但鉴于本数据集从输入数据到研制技术都较上一代数据产品有了大幅的改变,故将其版本号重新定义为 2.0。CMFD 2.0 的数据内容与此前宣传的 CMFD 1.7 基本一致,仅对 1983 年 7 月以后的向下短/长波辐射通量数据进行了更新,以修正其长期趋势存在的问题。
国家青藏高原科学数据中心 收录
高精度负荷预测
超短期统调负荷预测 短期统调负荷预测 D+45统调负荷预测
郑州数据交易中心 收录
HazyDet
HazyDet是由解放军工程大学等机构创建的一个大规模数据集,专门用于雾霾场景下的无人机视角物体检测。该数据集包含383,000个真实世界实例,收集自自然雾霾环境和正常场景中人工添加的雾霾效果,以模拟恶劣天气条件。数据集的创建过程结合了深度估计和大气散射模型,确保了数据的真实性和多样性。HazyDet主要应用于无人机在恶劣天气条件下的物体检测,旨在提高无人机在复杂环境中的感知能力。
arXiv 收录
DAGM 2007
DAGM 2007数据集是一个用于工业图像分类的基准数据集,主要用于研究表面缺陷检测。该数据集包含6个不同类别的图像,每个类别有1000张正常图像和150张带有缺陷的图像。数据集的目的是评估和比较不同算法在工业图像中的缺陷检测能力。
www.ais.uni-bonn.de 收录
danaroth/icvl
ICVL是一个高光谱图像数据集,由Specim PS Kappa DX4高光谱相机和旋转平台进行空间扫描采集。数据集目前包含200张图像,并且会逐步增加。图像的空间分辨率为1392×1300,覆盖519个光谱波段(400-1000nm,间隔约1.25nm)。数据集提供了ENVI格式的原始数据和MAT格式的下采样数据(31个光谱通道,400-700nm,间隔10nm)。原始数据集仅包含干净的图像,用于高光谱图像去噪的测试数据来自另一篇论文。
hugging_face 收录