遇见数据集

GeoChrono (包含ChronoBench和ChronoInstruct)

收藏
github2026-07-20 更新2026-07-21 收录
官方服务:

资源简介:

GeoChrono是一个用于遥感长期时间理解的数据集集合,包含ChronoBench和ChronoInstruct两个部分。ChronoBench是一个四级认知基准(土地覆盖感知→时间识别→长期记忆→时空推理),包含12个子任务和17,689个经过严格验证的问答对,覆盖39个美国主要城市的500个区域的3,469张高分辨率图像。ChronoInstruct是一个大规模指令调优数据集,包含104,949个问答对,支持三种答案格式(多项选择、短文本和自由形式自然语言)。

GeoChrono is a collection of datasets for long-term temporal understanding in remote sensing, which comprises two parts: ChronoBench and ChronoInstruct. ChronoBench is a four-level cognitive benchmark (land cover perception → temporal recognition → long-term memory → spatiotemporal reasoning), including 12 subtasks and 17,689 rigorously validated question-answer pairs, covering 3,469 high-resolution images from 500 regions across 39 major U.S. cities. ChronoInstruct is a large-scale instruction-tuning dataset containing 104,949 question-answer pairs, which supports three answer formats: multiple choice, short text, and free-form natural language.

创建时间:
2026-07-16
原始信息汇总

数据集概述

GeoChrono 是一个面向遥感领域长期时序理解的数据集与基准,包含以下三个核心组成部分:

  • ChronoBench:四级认知基准(Land Cover Perception → Temporal Recognition → Long-Term Memory → Spatio-Temporal Reasoning),涵盖 12 个子任务、17,689 个经过严格验证的问答对,涉及 3,469 张高分辨率图像,覆盖美国39个主要城市的500个区域。
  • ChronoInstruct:大规模指令微调数据集,包含 104,949 个问答对,分为三种答案格式:多项选择、短文本和自由形式自然语言。
  • GeoChrono:基于 Qwen3-VL-4B-Instruct 的遥感长期时序多模态大语言模型,引入 时序轨迹编码器(TempEnc)粗到细令牌压缩器(C2FComp),在 ChronoBench 上达到 78.34% 的总体准确率,超越领先商业模型超过20%。

数据集获取与使用

  • 数据下载:通过 Hugging Face 下载 ChronoBench 和 ChronoInstruct 数据集,影像需从 DVL-Suite 获取。
  • 模型权重:GeoChrono 模型权重(LoRA + TempEnc)在 Hugging FaceModelScope 发布。
  • 代码开源:基准构建、评估和训练代码全部开源在 GitHub

许可信息

数据集、模型权重及代码均采用 Apache License 2.0 许可。底层 DVL-Suite 影像及标注遵循其自身许可条款。

联系方式

如有问题或反馈,请提交 GitHub Issue 或联系 liyujie2003@bupt.edu.cn。

搜集汇总
数据集介绍
GeoChrono (包含ChronoBench和ChronoInstruct) 数据集图片
构建方式
GeoChrono数据集由ChronoBench与ChronoInstruct两大核心组件构成。其构建依托于DVL-Suite提供的人工标注语义变化掩膜,通过完全基于规则的全自动流水线,从覆盖美国39个主要城市的500个地理区域中,筛选出3469幅高分辨率遥感影像。在此基础上,系统性地生成了涵盖四个认知层级——土地覆盖感知、时间识别、长期记忆与时空推理——的12项子任务,共计17689个经过严格人工验证的问答对。ChronoInstruct则进一步扩展至104949个问答对,整合了选择题、短文本与自由形式自然语言三种答案格式,为模型指令微调提供了丰富素材。
特点
GeoChrono数据集的突出特点在于其分层递进的认知评估架构与精细的时间序列建模。ChronoBench从静态感知逐步过渡至跨时空推理,每一层级均对应明确的核心问题,构成了对遥感时序理解能力的全面考验。数据集的构建摒弃了纯数据驱动方法,转而采用严格的规则化流程与两阶段人工质量控制,确保了标注的准确性与逻辑一致性。此外,GeoChrono模型引入的临时轨迹编码器与由粗到细令牌压缩器,巧妙利用遥感影像中前景与背景的显著不均衡性,在压缩超过56%视觉令牌的同时保留了94.6%的模型性能。
使用方法
GeoChrono的使用流程清晰而系统。研究者首先通过HuggingFace下载ChronoBench与ChronoInstruct的标注文件,并配合DVL-Suite获取对应的遥感影像数据。评估阶段,模型需按照固定的1024×1024分辨率并以年份标记的交替提示方式输入图像,通过提供的评估脚本来计算各任务及层级上的准确率。训练阶段则聚焦于ChronoInstruct数据集,冻结视觉编码器与投影器,随机初始化临时轨迹编码器并完全微调,同时在语言模型骨干上应用低秩适配策略,结合DeepSpeed ZeRO-2进行单阶段高效训练。
背景与挑战
背景概述
遥感影像解译长期以来聚焦于静态场景或两时相的变化检测,地球表面持续发生的长期演化过程却被忽视。为填补这一空白,北京邮电大学研究团队于2026年构建了GeoChrono数据集,包含ChronoBench基准与ChronoInstruct指令微调数据。ChronoBench设计了从地表覆盖感知到时空推理的四级认知层次,涵盖12个子任务、涵盖美国39个主要城市500个区域的3469张高分辨率影像,并配有17689个经严格人工验证的问答对。该数据集首次系统性地将长期时间理解引入遥感领域,为多模态大语言模型在时间维度上的能力评估提供了标准化测试平台。
当前挑战
GeoChrono面临的挑战具有双重性。在领域问题层面,遥感长期时间理解需突破静态解译的局限,模型需要从多时相序列中捕捉地表覆盖的渐进式演变、识别时间点与事件间的因果关联,并完成跨空间与时间的推理,这对现有模型的时间感知与记忆能力构成严峻考验。在构建过程中,挑战同样显著:源自DVL-Suite的语义变化掩膜需转换为规则化问答对,人工标注的精确性与一致性难以保证;17700余条数据需经过两阶段质量控制,流程繁复。此外,时间序列影像的像素级对齐与大规模地理空间数据的标准化整理亦耗费巨大资源。
常用场景
经典使用场景
GeoChrono数据集在遥感领域最具代表性的使用场景,是评估多模态大语言模型对地表长期动态演变过程的理解能力。传统遥感解译方法多聚焦于单一时相影像或双时相变化检测,难以捕捉跨越数十年、涵盖多种地表覆盖类型转换的完整轨迹。ChronoBench作为该数据集的基准测试核心,精心设计了从低级土地覆盖感知到高级时空推理的四级认知体系,包含12个子任务与17,689个严格校验的问答对,覆盖美国39个主要城市500个区域的3,469张高分辨率影像。研究者利用该基准,能够系统性地测试模型在时间识别、长期记忆存储以及跨区域时空关联推理等维度的表现,从而推动遥感智能从静态分类向动态理解的范式跃迁。
实际应用
在实际应用层面,GeoChrono数据集及其配套模型GeoChrono展现出在智慧城市、精准农业与灾害监测等领域的巨大潜力。基于ChronoInstruct包含的104,949条高质量指令数据,GeoChrono模型能够准确回答跨越二十年的土地利用演变问题,例如追踪农田向城市用地的渐进转化、识别森林砍伐的历史窗口期或评估灾后重建的阶段性进程。在ChronoBench测试中,GeoChrono以78.34%的整体准确率超越领先商业模型逾20个百分点,证明其具备将时空特征提取与语言推理相融合的实用能力。这一技术突破使得遥感应用从简单的变化检测报表升级为能够回答"何时发生、如何演变、为何如此"等深度问题的智能决策支持系统,为城市规划者、农业分析师及应急管理部门提供了历史回溯与趋势预判的可操作工具。
衍生相关工作
GeoChrono数据集已催生出一系列相关经典工作,其中最核心的是其配套模型GeoChrono中创新的时间轨迹建模方法。该模型基于Qwen3-VL-4B-Instruct架构,引入时间轨迹编码器(TempEnc)与从粗到细的令牌压缩器(C2FComp),通过解耦时空特征体、实施混合时间注意力机制以及提示引导的显著性筛选,在缩减超过56%视觉令牌的同时保留了94.6%的模型性能。此外,该数据集架构中的数据构建流程具有高度可复现性——完全基于规则的全自动问答对生成管道与人类标注的语义变化掩码相结合,辅以两阶段质量控制,为后续研究者提供了构建同类基准的标准化模板。ChronoInstruct的三种答案格式(多选、短文本与自由格式)也启发了多模态指令微调数据的多样化设计思路,在遥感领域形成了从数据构造到模型训练再到能力评估的完整方法论闭环。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务