dibs-feature|多模态特征提取数据集|视频分析数据集
收藏DIBS Features 数据集
概述
DIBS Features 数据集包含了 YouCook2、ActivityNet 和 HowTo100M 自定义子集的预提取 CLIP 和 UniVL 特征。这些特征用于 DIBS 研究。
处理 HowTo100M 子集特征
要处理 HowTo100M 子集的特征,首先需要将所有分割文件合并,然后解压缩合并后的文件。具体命令如下: bash
合并分割文件
cat howto_subset_features.tar.gz.part* > howto_subset_features.tar.gz
解压缩合并后的文件
tar -xvzf howto_subset_features.tar.gz
文件结构
数据集的文件结构如下:
├── yc2 │ ├── clip_features │ │ ├── video │ │ │ ├── video1_clip.npy │ │ │ ├── video2_clip.npy │ │ │ └── ... │ │ ├── text_proj │ │ ├── v_video1.npy │ │ ├── v_video2.npy │ │ └── ... │ ├── UniVL_features │ ├── video │ │ ├── video1.npy │ │ ├── video2.npy │ │ └── ... │ ├── UniVL_visual │ │ ├── video1.npy │ │ ├── video2.npy │ │ └── ... │ ├── UniVL_text │ ├── video1.npy │ ├── video2.npy │ └── ... ├── anet_features │ ├── clip │ │ ├── clip_visual │ │ │ ├── v_video1_clip.npy │ │ │ ├── v_video2_clip.npy │ │ │ └── ... │ │ ├── clip_text_new │ │ ├── v_video1.npy │ │ ├── v_video2.npy │ │ └── ... │ ├── univl │ ├── video │ │ ├── v_video1.npy │ │ ├── v_video2.npy │ │ └── ... │ ├── visual │ │ ├── video1.npy │ │ ├── video2.npy │ │ └── ... │ ├── text │ ├── video1.npy │ ├── video2.npy │ └── ... ├── howto100m │ ├── clip_features │ │ ├── visual │ │ │ ├── video1_clip.npy │ │ │ ├── video2_clip.npy │ │ │ └── ... │ │ ├── text_proj │ │ ├── video1.npy │ │ ├── video2.npy │ │ └── ... │ ├── univl_features │ ├── video │ │ ├── video1.npy │ │ ├── video2.npy │ │ └── ... │ ├── visual │ │ ├── video1.npy │ │ ├── video2.npy │ │ └── ... │ ├── text │ ├── video1.npy │ ├── video2.npy │ └── ...

中国交通事故深度调查(CIDAS)数据集
交通事故深度调查数据通过采用科学系统方法现场调查中国道路上实际发生交通事故相关的道路环境、道路交通行为、车辆损坏、人员损伤信息,以探究碰撞事故中车损和人伤机理。目前已积累深度调查事故10000余例,单个案例信息包含人、车 、路和环境多维信息组成的3000多个字段。该数据集可作为深入分析中国道路交通事故工况特征,探索事故预防和损伤防护措施的关键数据源,为制定汽车安全法规和标准、完善汽车测评试验规程、
北方大数据交易中心 收录
MedDialog
MedDialog数据集(中文)包含了医生和患者之间的对话(中文)。它有110万个对话和400万个话语。数据还在不断增长,会有更多的对话加入。原始对话来自好大夫网。
github 收录
HazyDet
HazyDet是由解放军工程大学等机构创建的一个大规模数据集,专门用于雾霾场景下的无人机视角物体检测。该数据集包含383,000个真实世界实例,收集自自然雾霾环境和正常场景中人工添加的雾霾效果,以模拟恶劣天气条件。数据集的创建过程结合了深度估计和大气散射模型,确保了数据的真实性和多样性。HazyDet主要应用于无人机在恶劣天气条件下的物体检测,旨在提高无人机在复杂环境中的感知能力。
arXiv 收录
Papersnake/people_daily_news
人民日报(1946-2023)数据集是CialloCorpus的一部分。
hugging_face 收录
Yahoo Finance
Dataset About finance related to stock market
kaggle 收录