登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
MicroG-4M
MicroG-4M
收藏
DataONE
2025-05-20 更新
2025-11-01 收录
重力环境
多模态学习
数据链接:
https://search.dataone.org/view/sha256:bf7a3b4a797b6a14cfefcc180f85d4c237b1bd5a8b2afa1e701967e3db575679
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Designed for HAR, VQA, Captioning in microgravity environments
应用场景:
创建时间:
2025-10-29
相关数据集
ShareGPT4Video
多模态学习
自然语言处理
# ShareGPT4Video 4.8M Dataset Card ## Dataset details **Dataset type:** ShareGPT4Video Captions 4.8M is a set of GPT4-Vision-powered multi-modal captions data of videos. It is constructed to enhan
魔搭社区
2026-07-08 更新
44
0
LongVPO-Training-Data
视频理解
多模态学习
LongVPO是一个用于长视频偏好优化的多模态数据集,旨在通过两个渐进式训练阶段提升模型的视频理解能力。第一阶段(Anchored Cues Optimization)使用来自LLaVA-Video-178K的短到长视频对齐数据,专注于锚定关键时间事件以防止注意力漂移。第二阶段(Self-Reasoning Optimization)则利用Vript的长视频数据集,训练模型自主推理跨视频的多个事件
Hugging Face
2026-03-07 更新
17
0
SoundingEarth
多模态学习
地理空间音频识别
该数据集是一个多模态数据集,包含音频、图像和文本数据。主要特征包括音频文件(采样率为32kHz)、谷歌地球图像、音频字幕及其来源、梅尔频谱特征(形状为5x1x1001x64的浮点数组)、基于LLaVA模型的谷歌地球图像字幕、经纬度坐标以及录制日期。数据集分为训练集(40,241个样本)、验证集(3,242个样本)和测试集(5,801个样本),总大小约为498GB。该数据集适用于多模态学习任务,如音
Hugging Face
2026-04-26 更新
13
0
smol-libero
机器人视觉
多模态学习
Smol-LIBERO是一个LIBERO基准的紧凑版本,大小仅为1.79 GB(相比之下,完整的LIBERO约为34 GB)。它包含较少的轨迹和摄像头,但保持了多种模式结构。每个样本包括来自两个固定摄像头的图像、两种类型的机器人状态(末端执行器位姿+夹爪和完整的7自由度关节位置)以及动作(7自由度关节命令)。这种设置特别适合比较低维状态输入和高维视觉输入,或者在多模态训练中将它们结合起来。
Hugging Face
2025-09-08 更新
42
0
litwell/MMTrail-20M
多模态学习
多模态研究
MMTrail是一个大规模的多模态视频-语言数据集,包含超过20M的预告片剪辑,具有高质量的视觉帧和背景音乐的多模态字幕。数据集旨在增强跨模态研究和细粒度的多模态语言模型训练。数据集提供了超过2M的LLaVA视频字幕、2M的音乐字幕和60M的Coca帧字幕,涵盖了27.1k小时的预告片视频。数据集的特点包括多样的主题和内容类型,以及定制的背景音乐,使其与视觉内容更加一致。数据集通过先进的LLM技术
Hugging Face
2024-11-07 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广