PRICE
收藏资源简介:
PRICE(真实世界交互约束预测评估)V0.1是一个基于真实世界机器人、自我中心视角和第三人称交互数据的指令条件图像到图像生成基准数据集,旨在评估模型在给定初始状态图像和自然语言指令的情况下,预测指令动作所产生的目标状态图像的能力,评估重点包括指令遵循准确性、场景一致性和物理合理性。数据集包含100个测试样本,每个样本由初始状态图像(query)、参考目标状态图像(output)和自然语言指令(lang)构成,数据来源于AgiBot World(30个样本)、HomeInteract(20个样本)、PE-Video(20个样本)和PsiBot SynData(30个样本)。每个样本还包括稳定的标识符(id)和数据来源标识(dataset)。该数据集适用于图像生成、机器人学、具身人工智能等领域的模型评估,特别关注真实世界交互场景中的物理约束和指令理解,采用Apache 2.0许可证发布,所有内容均为英文。
PRICE (Real-world Interaction Constraint Prediction Evaluation) V0.1 is a benchmark dataset for instruction-conditioned image-to-image generation based on real-world robot, egocentric, and third-person interaction data. It aims to evaluate the ability of models to predict target state images resulting from instructed actions given an initial state image and a natural language instruction, with a focus on instruction-following accuracy, scene consistency, and physical plausibility. The dataset contains 100 test samples, each consisting of an initial state image (query), a reference target state image (output), and a natural language instruction (lang) describing the action. The data is sourced from four interaction datasets: AgiBot World (30 samples), HomeInteract (20 samples), PE-Video (20 samples), and PsiBot SynData (30 samples). Each sample also includes a stable identifier (id) and a dataset source indicator (dataset). It is suitable for model evaluation in fields such as image generation, robotics, and embodied AI, particularly focusing on physical constraints and instruction understanding in real-world interaction scenarios. The dataset is released under the Apache 2.0 license, and all content is in English.
数据集名称
PRICE (Prediction of Real-world Interactions with Constraints Evaluation) - 版本 V0.1
数据集简介
PRICE-V0.1 是一个用于指令条件图像到图像生成的基准测试,基于真实世界的机器人、第一人称视角和第三人称视角交互数据。给定初始状态图像和自然语言指令,模型需要预测执行指令动作后的目标状态图像。该基准评估了指令遵循、场景一致性和物理合理性。
任务类别
- 图像到图像生成
- 指令条件图像生成
- 具身智能与机器人交互
语言
- 英语(en)
许可协议
- Apache 2.0
数据集大小
- 样本总数:小于 1,000(具体为 100 个样本)
数据集结构
数据集包含一个 test 分割,共 100 个样本,主要字段如下:
| 列名 | 类型 | 描述 |
|---|---|---|
| id | string | 稳定的 PRICE 样本标识符 |
| query | image | 初始状态图像 |
| output | image | 参考目标状态图像 |
| lang | string | 自然语言动作指令 |
| dataset | string | 源数据集标识符 |
数据来源与样本分布
| 源数据集 | 样本数 |
|---|---|
| agibot_world | 30 |
| homeinteract | 20 |
| pe_video | 20 |
| psi_ego | 30 |
| 总计 | 100 |
使用方式
通过 Hugging Face 的 datasets 库加载:
python
from datasets import load_dataset
dataset = load_dataset("BAAI/PRICE", split="test")
sample = dataset[0]
initial_image = sample["query"]
target_image = sample["output"]
instruction = sample["lang"]
也可从本地文件夹加载: python from datasets import load_dataset dataset = load_dataset("imagefolder", data_dir="data", split="test")
评估方法
评估代码和协议位于 GitHub 仓库 orca-wm/Orca 的 evaluation/image_gen/PRICE/ 目录中。模型预测结果应按照对应 id 命名,并遵循仓库中记录的布局。
参考资源
- 评估代码仓库:orca-wm/Orca 评估目录
- 基准示例概览图:PRICE_Overview.png
- 详细来源引用和选择细节参见 PRICE 论文及 GitHub 仓库
版本信息
- 当前版本:PRICE-V0.1
- 建议在 Hugging Face 数据集仓库中标记为
v0.1版本,并在评估代码中锁定该修订版本以确保结果可复现




