alex-miller/oecd-dac-crs|国际援助数据集|发展合作数据集
收藏数据集概述
基本信息
- 名称: OECD DAC CRS Project titles and descriptions
- 语言: 英语、法语、西班牙语
- 许可证: cc
- 大小: 1M<n<10M
- 任务类别: mask-generation
数据集特征
- text: 字符串类型,包含项目标题、简短描述和详细描述的组合。
- Year: 整数类型
- ProjectNumber: 字符串类型
- RecipientName: 字符串类型
- RecipientCode: 整数类型
- DonorName: 字符串类型
- DonorCode: 整数类型
- ProjectTitle: 字符串类型
- SectorName: 字符串类型
- PurposeName: 字符串类型
- FlowName: 字符串类型
- ChannelName: 字符串类型
- ShortDescription: 字符串类型
- LongDescription: 字符串类型
数据集分割
- 训练集:
- 大小: 1693492524 字节
- 示例数量: 1870757
下载与数据集大小
- 下载大小: 700898490 字节
- 数据集大小: 1693492524 字节
配置
- 默认配置:
- 数据文件路径: data/train-*
VisDrone2019
VisDrone2019数据集由AISKYEYE团队在天津大学机器学习和数据挖掘实验室收集,包含288个视频片段共261,908帧和10,209张静态图像。数据集覆盖了中国14个不同城市的城市和乡村环境,包括行人、车辆、自行车等多种目标,以及稀疏和拥挤场景。数据集使用不同型号的无人机在各种天气和光照条件下收集,手动标注了超过260万个目标边界框,并提供了场景可见性、对象类别和遮挡等重要属性。
github 收录
AgiBot World
为了进一步推动通用具身智能领域研究进展,让高质量机器人数据触手可及,作为上海模塑申城语料普惠计划中的一份子,智元机器人携手上海人工智能实验室、国家地方共建人形机器人创新中心以及上海库帕思,重磅发布全球首个基于全域真实场景、全能硬件平台、全程质量把控的百万真机数据集开源项目 AgiBot World。这一里程碑式的开源项目,旨在构建国际领先的开源技术底座,标志着具身智能领域 「ImageNet 时刻」已到来。AgiBot World 是全球首个基于全域真实场景、全能硬件平台、全程质量把控的大规模机器人数据集。相比于 Google 开源的 Open X-Embodiment 数据集,AgiBot World 的长程数据规模高出 10 倍,场景范围覆盖面扩大 100 倍,数据质量从实验室级上升到工业级标准。AgiBot World 数据集收录了八十余种日常生活中的多样化技能,从抓取、放置、推、拉等基础操作,到搅拌、折叠、熨烫等精细长程、双臂协同复杂交互,几乎涵盖了日常生活所需的绝大多数动作需求。
github 收录
poi
本项目收集国内POI兴趣点,当前版本数据来自于openstreetmap。
github 收录
Arizona Cities by Population
A dataset listing Arizona cities by population for 2024.
www.arizona-demographics.com 收录
Global Volcanism Program (GVP)
该数据集包含了全球火山活动的详细信息,包括火山的位置、类型、历史喷发记录、喷发频率等。数据集还提供了关于火山活动的研究报告和相关文献的链接。
volcano.si.edu 收录