EgoNight
收藏资源简介:
EgoNight是第一个全面的基准测试,旨在评估低光和夜间条件下的自我中心视觉理解,填补了当前研究中的一个关键空白。
EgoNight is the first comprehensive benchmark designed to evaluate egocentric visual understanding under low-light and nighttime conditions, filling a critical gap in current research.
EgoNight 数据集概述
数据集简介
EgoNight 是首个用于评估低光照和夜间条件下第一人称(自我中心)视觉理解的综合性基准。它旨在填补当前研究中的一个关键空白。
核心功能
该基准用于评估视觉-语言模型在各种场景下的第一人称视频问答能力。它同时支持夜间(默认)和白天图像,并包含一个用于成对日/夜比较的精选问题类型子集。
问题类型
- 物体识别
- 空间推理
- 场景序列
- 非常见
- 计数
- 导航
- 文本识别
- 动作
数据集构成
数据集包含三个子集:
- EgoNight-Sofia
- EgoNight-Oxford
- EgoNight-Synthetic
数据格式
每个评估样本是一个子文件夹,包含以下结构:
<subfolder>/ ├── qa_result/ │ ├── all_qa_filtered.json # 问答标注文件 │ ├── _results.json # 模型输出文件 │ └── _scores.json # 评分输出文件 └── extracted_frames/ ├── Night/ # 夜间图像 └── Day/ # 白天图像(可选)
帧采样率
- EgoNight-Sofia 和 EgoNight-Oxford:以 1 fps 采样
- EgoNight-Synthetic:以 2 fps 采样
标注文件 (all_qa_filtered.json)
该文件为对象列表,包含以下字段:
question:问题文本question_type:问题类型(如上所列)answer:真实答案start_frame:起始帧索引(从0开始)end_frame:结束帧索引(包含)
评估与输出
支持的评估模型
- GPT-4.1
- Gemini 2.5 Pro
- Qwen 2.5 VL 7B(需本地API服务器)
输出文件
- GPT:
gpt_results.json/gpt_results_day.json - Gemini:
gemini_results.json/gemini_results_day.json - Qwen 7B:
qwen7b_results.json/qwen7b_results_day.json
每个结果JSON文件包含条目,字段有:Q(问题)、A(预测)、C(真实答案)、M(类别)以及帧索引。
评分输出
评分过程生成 *_scores.json 文件,包含GPT-4o的评估结果:正确/错误、0–5分评分以及推理过程。
许可证
GNU General Public License v3.0。详细信息见 https://github.com/dehezhang2/EgoNight/blob/main/LICENSE



