Ego4D & Ego-Exo4D|计算机视觉数据集|机器学习数据集
收藏Ego-Exo4D 数据集概述
- 版本: V2
- 视频时长: 1286.30小时(其中221.26小时为第一人称视角)
- 视频数量: 5035个片段
- 特点: 包含更多注释
- 访问: 请参考Getting Started页面
- 下载: 使用Ego-Exo4Ds Downloader CLI README
Ego4D 数据集概述
- 版本: V2.1
- 新增内容: 包含Goal-Step注释和伴随的“分组视频”
- 视频时长: 超过3700小时的第一人称视频数据
- 访问: 请参考Start Here页面
- 下载: 使用Ego4Ds CLI README
数据集功能与工具
- 下载工具: 分别为Ego-Exo4D和Ego4D提供了专门的命令行工具
- 视频读取API: 抽象了常见的视频读取库,如TorchAudio和PyAV
- 特征提取API: 包括对常见模型的轻量级包装,如Omnivore和SlowFast
- 研究代码: 提供训练模型的研究代码,例如clep
数据集使用教程
- Notebooks: 提供用于分析和使用数据集的示例/教程
- Colab Notebooks: 为基准测试提供额外的示例
数据集可视化
- 可视化工具: 提供可视化引擎和演示笔记本
许可证
- Ego4D: 根据MIT License发布

中国1km分辨率逐月降水量数据集(1901-2023)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2023.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
中国气象数据
本数据集包含了中国2023年1月至11月的气象数据,包括日照时间、降雨量、温度、风速等关键数据。通过这些数据,可以深入了解气象现象对不同地区的影响,并通过可视化工具揭示中国的气温分布、降水情况、风速趋势等。
github 收录
CatMeows
该数据集包含440个声音样本,由21只属于两个品种(缅因州库恩猫和欧洲短毛猫)的猫在三种不同情境下发出的喵声组成。这些情境包括刷毛、在陌生环境中隔离和等待食物。每个声音文件都遵循特定的命名约定,包含猫的唯一ID、品种、性别、猫主人的唯一ID、录音场次和发声计数。此外,还有一个额外的zip文件,包含被排除的录音(非喵声)和未剪辑的连续发声序列。
huggingface 收录
ST-EVCDP
这是一个关于公共电动汽车充电桩的时空充电需求预测的实际数据集,涵盖了18,061个公共充电桩的数据,包括坐标、充电器数量、占用情况和价格等信息。数据集用于学术研究,支持区域电动汽车充电需求预测。
github 收录
Eurovision Song Contest Dataset
Eurovision Song Contest数据集是一个免费提供的数据集,包含1735首参赛歌曲的音频特征、元数据、比赛排名和投票数据,这些歌曲参与了从1956年到2023年的Eurovision Song Contest。
github 收录