free-music-archive-large|音乐分析数据集|开源数据集数据集
收藏数据集概述
基本信息
- 数据集名称: Free Music Archive - Large
- 数据集大小: 100K<n<1M
- 任务类别:
- 音频到音频
- 音频分类
数据集配置
配置名称: commercial
- 特征:
audio
: 音频数据title
: 字符串url
: 字符串artist
: 字符串composer
: 字符串lyricist
: 字符串publisher
: 字符串genres
: 序列,包含164个分类标签tags
: 字符串序列released
: 时间戳language
: 字符串listens
: 无符号64位整数artist_url
: 字符串artist_website
: 字符串album_title
: 字符串album_url
: 字符串license
: 分类标签,包含33种许可证copyright
: 字符串explicit
: 分类标签,是否包含明确内容instrumental
: 分类标签,是否为器乐allow_commercial_use
: 分类标签,是否允许商业使用allow_derivatives
: 分类标签,是否允许衍生作品require_attribution
: 分类标签,是否需要署名require_share_alike
: 分类标签,是否需要相同方式共享
- 分割:
train
: 8380个样本,6730446047.6字节
- 下载大小: 7974179100字节
- 数据集大小: 6730446047.6字节
配置名称: default
- 特征:
audio
: 音频数据title
: 字符串url
: 字符串artist
: 字符串composer
: 字符串lyricist
: 字符串publisher
: 字符串genres
: 序列,包含164个分类标签tags
: 字符串序列released
: 时间戳language
: 字符串listens
: 无符号64位整数artist_url
: 字符串artist_website
: 字符串album_title
: 字符串album_url
: 字符串license
: 分类标签,包含33种许可证copyright
: 字符串explicit
: 分类标签,是否包含明确内容instrumental
: 分类标签,是否为器乐allow_commercial_use
: 分类标签,是否允许商业使用allow_derivatives
: 分类标签,是否允许衍生作品require_attribution
: 分类标签,是否需要署名require_share_alike
: 分类标签,是否需要相同方式共享
- 分割:
train
: 105033个样本,85239274784.388字节
- 下载大小: 100325400918字节
- 数据集大小: 85239274784.388字节
许可证信息
- 数据集代码库: MIT许可证
- 元数据: CC-BY 4.0许可证
- 音频文件: 多种Creative Commons许可证,每个文件附带其许可证详情
数据集详情
- 总样本数: 105,024个
- 音频时长: 30秒每个样本
- 总时长: 869.2小时
- 分类: 16个不平衡的流派
数据集清理
- 不可读文件: 173个文件被移除
- 许可证不明确文件: 1377个文件被移除

中国1km分辨率逐月降水量数据集(1901-2023)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2023.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
中国区域交通网络数据集
该数据集包含中国各区域的交通网络信息,包括道路、铁路、航空和水路等多种交通方式的网络结构和连接关系。数据集详细记录了各交通节点的位置、交通线路的类型、长度、容量以及相关的交通流量信息。
data.stats.gov.cn 收录
AgiBot World
为了进一步推动通用具身智能领域研究进展,让高质量机器人数据触手可及,作为上海模塑申城语料普惠计划中的一份子,智元机器人携手上海人工智能实验室、国家地方共建人形机器人创新中心以及上海库帕思,重磅发布全球首个基于全域真实场景、全能硬件平台、全程质量把控的百万真机数据集开源项目 AgiBot World。这一里程碑式的开源项目,旨在构建国际领先的开源技术底座,标志着具身智能领域 「ImageNet 时刻」已到来。AgiBot World 是全球首个基于全域真实场景、全能硬件平台、全程质量把控的大规模机器人数据集。相比于 Google 开源的 Open X-Embodiment 数据集,AgiBot World 的长程数据规模高出 10 倍,场景范围覆盖面扩大 100 倍,数据质量从实验室级上升到工业级标准。AgiBot World 数据集收录了八十余种日常生活中的多样化技能,从抓取、放置、推、拉等基础操作,到搅拌、折叠、熨烫等精细长程、双臂协同复杂交互,几乎涵盖了日常生活所需的绝大多数动作需求。
github 收录
YOLO Drone Detection Dataset
为了促进无人机检测模型的开发和评估,我们引入了一个新颖且全面的数据集,专门为训练和测试无人机检测算法而设计。该数据集来源于Kaggle上的公开数据集,包含在各种环境和摄像机视角下捕获的多样化的带注释图像。数据集包括无人机实例以及其他常见对象,以实现强大的检测和分类。
github 收录
中国农村教育发展报告
该数据集包含了中国农村教育发展的相关数据,涵盖了教育资源分布、教育质量、学生表现等多个方面的信息。
www.moe.gov.cn 收录