遇见数据集

RekaDaily-10k-raw

收藏
Hugging Face2026-08-07 更新2026-08-08 收录
官方服务:

资源简介:

RekaDaily-10k (raw) 是一个面向自我中心(第一人称)日常生活的原始视频数据集。该数据集通过 Reka 的 Claru 数据收集市场,由付费收集者在其家中和工作场所使用头戴式或手持手机录制,覆盖多个地理区域。视频内容为未剪辑、自发的日常活动,未经过重新编码、裁剪或除基本完整性检查之外的筛选。当前发布版本包含约 1,883 小时、82,244 个视频,存储为 4,015 个 WebDataset tar 存档(每个约 5-8 GB),并正在逐步增长至完整的 10,312 小时。数据按项目组织,例如 egocentric_household_tasks、video_capture 等。每个视频附带一个 JSON 侧边文件,包含元数据字段:video_id(唯一标识)、project(收集项目)、flow/activities(活动分类)、category/subcategory(类别分类)、lighting(光照条件)、duration_s(时长)、fps(帧率)、width/height(分辨率)、num_frames(帧数)、codec(编码格式)、collector(收集者哈希值)。元数据也以 parquet 格式提供:browse.parquet 包含缩略图,index.parquet 不含缩略图。该数据集已移除容器元数据(GPS、设备标识符、时间戳)并经过自动 PII 筛查,但筛查不完美,如有问题可联系删除。适用任务包括自我中心视频分类、日常活动识别、视频理解、图像到视频的转换等。许可为 Apache 2.0,允许商业使用和再分发。

RekaDaily-10k (raw) is a raw video dataset of egocentric (first-person) daily life. The dataset was collected via Rekas Claru data collection marketplace, recorded by paid collectors in their homes and workplaces using head-mounted or handheld phones, covering multiple geographic regions. The video content consists of unedited, spontaneous daily activities, without re-encoding, cropping, or filtering beyond basic integrity checks. The current release contains approximately 1,883 hours, 82,244 videos, stored as 4,015 WebDataset tar archives (each about 5-8 GB), and is gradually growing to the full 10,312 hours. Data is organized by project, such as egocentric_household_tasks, video_capture, etc. Each video is accompanied by a JSON sidecar file containing metadata fields: video_id (unique identifier), project (collection project), flow/activities (activity classification), category/subcategory (category classification), lighting (lighting conditions), duration_s (duration), fps (frame rate), width/height (resolution), num_frames (number of frames), codec (encoding format), collector (collector hash). Metadata is also provided in parquet format: browse.parquet includes thumbnails, index.parquet does not. The dataset has removed container metadata (GPS, device identifiers, timestamps) and undergone automatic PII screening, but screening is not perfect; contact for removal if issues arise. Applicable tasks include egocentric video classification, daily activity recognition, video understanding, image-to-video conversion, etc. The license is Apache 2.0, allowing commercial use and redistribution.

创建时间:
2026-08-05
原始信息汇总

RekaDaily-10k (raw) 数据集详情

数据集概述

RekaDaily-10k (raw) 是一个通过 Reka 旗下的 Claru 数据采集市场收集的无脚本、第一人称视角日常视频数据集,由付费采集者在不同地区的家庭和工作场所,使用头戴式或手持手机录制。当前发布约 1,883 小时 / 82,244 个视频 / 4,015 个分片(shards),并正在增量扩展至完整的 10,312 小时发布版本。视频保持原始状态,未经过重新编码或裁剪,仅进行了基础完整性检查。

数据集结构

  • 视频被打包为 WebDataset tar 存档(约 5-8 GB),按采集项目组织
  • data/<project>/shard-NNNNN.tar:包含视频文件与对应 JSON 元数据
  • metadata/browse.parquet:每个视频一行,包含缩略图及全部元数据字段
  • metadata/index.parquet:不含缩略图的元数据字段
  • sample/:约 400 个松散视频,便于快速浏览
  • 支持通过 WebDataset 阅读器直接加载数据分片

元数据字段

每个视频的 JSON 伴生文件及 parquet 表包含以下字段:

字段 说明
video_id 唯一标识,与媒体文件名一致
project Claru 采集项目名称
flowactivities 活动分类(activities 类项目):会话场景与执行动作
categorysubcategory 类别分类(video-capture 类项目)
lighting 采集时的光照条件
duration_sfpswidthheightnum_framescodec 视频探测统计信息
collector 加盐哈希的采集者 ID,不同值约等于不同录制环境

根据项目类型,每个视频填充一类分类体系(flow/activities 或 category/subcategory)。

采集项目

包含以下项目:egocentric_household_tasksegocentric_household_tasks_usaegocentric_commercial_environmentsresidential_egocentric_latam_upload_via_claruvideo_capture_activitiesvideo_capturevideo_capture_first_person_videos_phone

数据配置

  • browse(默认):每行含缩略图及全部元数据,适合快速浏览
  • metadata:不含缩略图的元数据,适合轻量级程序化读取

隐私与合规

  • 采集者为知情同意的付费承包商,录制前获得佩戴者同意
  • 要求征得其他在场成人同意,并尽量避免他人入镜
  • 所有视频已移除容器元数据(GPS 坐标、设备标识符、录制时间戳),并经过自动化 PII 筛查
  • 提供删除请求机制,可通过 contact@reka.ai 联系

许可协议

数据集采用 Apache 2.0 许可证,允许商业使用、再分发和基于该数据的构建,需按许可证条款注明出处。

搜集汇总
数据集介绍
RekaDaily-10k-raw 数据集图片
构建方式
RekaDaily-10k-raw数据集通过Reka旗下的Claru数据采集市场,由受薪采集人员在自身住宅与工作场所佩戴头戴式或手持式手机进行自然状态下的第一视角视频采集,涵盖多个地理区域。原始视频未经转码或剪辑,仅执行基本完整性校验,并按采集项目组织成WebDataset tar归档。每个视频配有对应的JSON元数据文件,记录采集项目、活动分类、光照条件、技术参数及匿名化采集者标识等信息。
特点
该数据集以其无脚本、真实的第一人称日常生活视频为核心特征,当前包含约1,883小时、82,244个视频片段,分布于4,015个分片。所有视频均保留原始编码与时长,未经过滤或后期加工,真实反映了日常场景的多样性。数据集提供两种元数据表格,其中browse配置包含缩略图以便快速浏览,同时严格保障隐私,移除一切可识别设备与位置信息,并遵循Apache 2.0许可。
使用方法
用户可通过WebDataset加载器便捷地访问视频分片,例如使用Python的webdataset库直接读取HuggingFace上的tar文件。数据集在HuggingFace上提供可浏览的表格视图,便于预览缩略图与元数据,同时提供轻量级的metadata配置供程序化读取。该数据集支持多种下游任务,如视频分类、图像到视频生成,并可用于多模态模型训练与评估,尤其适合研究第一视角理解与日常活动识别。
背景与挑战
背景概述
RekaDaily-10k-raw数据集由Reka AI于2024年创建,通过其数据采集平台Claru,由分布在不同地区的付费采集者在自家及工作场所使用头戴式和手持设备记录的真实、无脚本的第一人称日常生活视频。该数据集旨在为以自我为中心的视频理解、家庭操作任务分析及视频生成等领域提供大规模、多样化的原始视频资源,其当前版本包含约1,883小时、82,244个视频片段,并计划扩展至完整的10,312小时。作为一项重要的公开资源,它填补了高质量、多区域、真实场景下第一人称视频数据的空白,对推动视频分类、图像到视频生成等计算机视觉任务的研究具有显著影响力。
当前挑战
该数据集面临的挑战首先体现在其目标领域——第一人称视频理解与生成——的固有复杂性上,包括捕捉长时间序列中的细粒度动作、处理视角剧烈变化、光照条件多变以及场景杂乱等问题。其次,在数据构建过程中,采集环节需应对多区域、多设备带来的视频编码、分辨率及帧率不一致性;同时,需严格保障参与者隐私,通过去除元数据(如GPS、设备ID、时间戳)及自动化PII筛查来降低敏感信息泄露风险,但筛查的非绝对性要求持续的审查与应对机制。此外,数据集以原始未裁剪形式发布,缺乏人工标注的语义片段,这也为直接应用于监督学习任务带来挑战。
常用场景
经典使用场景
RekaDaily-10k-raw作为大规模、无脚本的第一人称日常视频语料库,其经典使用场景聚焦于视频分类与图像到视频的生成任务。研究者可依托其丰富的自我中心视角数据,训练模型识别复杂的日常活动(如家务操作、工具使用),或利用其时间连贯性生成逼真的第一人称视频序列。该数据集以原始未剪辑形式提供,保留了真实环境中的光照变化、视角晃动和多场景覆盖,为算法在非受控条件下的鲁棒性评估提供了理想基准,尤其适用于迁移学习与多模态理解的预训练阶段。
衍生相关工作
该数据集衍生了多个方向的经典工作,包括自我中心视频的时空动作检测、长时视频理解中的记忆机制研究,以及基于对比学习的跨视角特征对齐。其处理版本RekaDaily-10k(含机器字幕的短片段)催生了视频描述生成和叙事推理的相关研究。此外,研究者利用其多项目结构探索数据混合策略,以提升基础模型的泛化能力,相关成果可复现于公开的WebDataset加载框架中,促进了可复现实验生态的建设。
数据集最近研究
最新研究方向
当前,以RekaDaily-10k-raw为代表的第一视角日常视频数据集,正引领具身智能与多模态学习领域迈向新纪元。该数据集通过众包平台收集的无脚本、真实生活场景视频,为理解人类在家庭及工作环境中的精细操作提供了前所未有的数据规模与生态效度。前沿研究聚焦于利用此类原始视频流进行情景感知的视觉-语言预训练,以及开发能够从第一人称视角学习复杂操作序列的机器人模仿学习模型。其无剪辑、多区域采集的特性,使得模型能够在多样化的真实环境中进行鲁棒性训练,从而弥合仿真与现实之间的鸿沟。随数据集增量发布与处理的标准化,它正成为评估多模态视频理解、时序动作定位以及长程任务规划能力的基准,有力推动家用机器人和增强现实等应用的发展。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务