mtma
收藏资源简介:
该数据集来源于 Multi-Turn Moral Alignment 项目,旨在研究多轮交互中的道德对齐问题。数据集包含 MACHIAVELLI 环境的结构化 rollout 数据,具体包括:records/structure3/ 目录下有 20123 个起点,生成了 2.57M 个随机策略 episodes(按游戏、深度和行走种子网格划分),每个 episode 记录了动作、节点 ID、注释和派生奖励,但出于版权原因,不包含游戏文本(观察和选择文本)。此外,还提供了收集日志(records/logs/)和训练运行产物(runs/),包括每次运行的日志、指标和 rollout 转储。数据集可用于强化学习环境分析、道德对齐研究、策略评估等任务。
This dataset originates from the Multi-Turn Moral Alignment project, aiming to study moral alignment in multi-turn interactions. It contains structured rollout data from the MACHIAVELLI environment, specifically: the records/structure3/ directory includes 20,123 starting points, generating 2.57M random policy episodes (gridded by game, depth, and walk seed). Each episode records actions, node IDs, annotations, and derived rewards, but does not include game text (observations and choice texts) due to copyright reasons. Additionally, collection logs (records/logs/) and training run artifacts (runs/) are provided, including logs, metrics, and rollout dumps for each run. The dataset can be used for reinforcement learning environment analysis, moral alignment research, policy evaluation, and other tasks.
数据集概述:mtma
该数据集是“多轮道德对齐(Multi-Turn Moral Alignment)”项目的运行产物(run artifacts),主要包含环境分析与强化学习训练相关的数据。
主要内容
数据集划分为三大类文件:
records/structure3/:MACHIAVELLI 环境结构的回放数据(v3 版本)。包含 20,123 个起始点,以及覆盖“游戏 × 深度 × 行走种子”网格的 257 万条随机策略回合数据。具体布局、记录模式及数据提取方法详见对应子目录中的README.md文件。records/logs/:上述回放数据的收集日志。runs/:训练运行产物,包括每次运行的日志、指标和回放数据转储。
数据组织方式
records/用于存放分析数据;runs/用于存放训练输出;- 两者分开管理,互不混淆。
重要约束
数据集中不包含任何游戏文本。 MACHIAVELLI 的游戏脚本是 136 个商业 Choice of Games 标题的受版权保护内容。本数据集中的每条记录均已去除观察文本和选项文本,仅保留动作、节点 ID、标注信息及衍生奖励。该去除过程是无损的——在给定起始点和动作序列的情况下,环境是确定性的,可以完整重建原始过程。




