storyworld-plays
收藏资源简介:
该数据集名为“Storyworld Plays: Jinn and Beast Moral-Choice Evaluations”,是用于评估语言模型在多智能体叙事世界中道德选择行为的数据集。它包含第一个分片(shard)——来自论文《Jinn or Beast?》的“Jinn Town”战役,该战役采用模式引导(schema-guided)设计,包含24个两座、八回合的episode,共192个公开回合。数据集中还包含三个开发世界、四个固定宪法集会(constitutional assemblies)和两个配对种子;记录了执行过的LDT、TRM和SRT标识符及其公开访问凭证;提供了选定的动作、公共消息、公共理由、预测、环境结果和预测分数;以及24个episode摘要和论文中的描述性集会与配对块基准。此外,还包括用于前瞻性宪法选择架构的详尽机器可读选择矩阵。所有数据行均为“仅评估”(EVALUATION_ONLY)性质,属于模型支持的探索性开发证据,不得用于适配器训练、支架选择器调优或混合到后续的保留测试中。数据集的后续追加部分包括Temptation MAS v1(六阶段、仅公开的诱惑和多智能体控制网格评估)和Staged public control-mesh v2(基于Qwen3.5-0.8B GGUF的公开两通道路由与决策合约评估)。
This dataset, titled *Storyworld Plays: Jinn and Beast Moral-Choice Evaluations*, is designed to evaluate moral choice behaviors of large language models (LLMs) in multi-agent narrative worlds. It includes its first shard: the "Jinn Town" scenario from the paper *Jinn or Beast?*. This scenario adopts a schema-guided design, consisting of 24 two-player, eight-turn episodes, totaling 192 public turns. The dataset also contains three development worlds, four fixed constitutional assemblies, and two paired seeds; it records executed LDT, TRM and SRT identifiers along with their public access credentials. It provides selected actions, public messages, public justifications, predictions, environmental outcomes and prediction scores, as well as 24 episode summaries and the descriptive assembly and paired block benchmarks from the original paper. Furthermore, it includes a comprehensive machine-readable choice matrix for proactive constitutional choice architectures. All data entries are of the "EVALUATION_ONLY" nature, serving as exploratory development evidence supported by models, and must not be used for adapter training, bracket selector tuning or mixing into subsequent held-out tests. The subsequent extended portions of the dataset include Temptation MAS v1 (six-stage, publicly-only temptation and multi-agent control grid evaluations) and Staged public control-mesh v2 (public two-path routing and decision contract evaluations based on Qwen3.5-0.8B GGUF).
Storyworld Plays: Jinn and Beast Moral-Choice Evaluations
数据集概述
该数据集是一个可追加的、公开可执行的storyworld评估记录集合,首个分片包含来自《Jinn or Beast? Theological Identity Frames as Alignment Surfaces in Small Language Models》论文中完整的schema-guided Jinn Town活动数据。数据集语言为英语,规模小于1K条记录,采用other许可证。
核心内容
首个分片包含:
- 来自24个两座、八回合剧集的192个公开回合
- 三个开发世界、四个固定宪法议会和两个配对种子
- 已执行的LDT、TRM和SRT标识符及其公开的survivor/visit收据
- 选定的动作、公开消息、公开理由、预测、环境结果和预测分数
- 24个剧集摘要及论文中的描述性议会和配对块基准
- 面向预期宪法选择架构的详尽机器可读选择矩阵
配置结构
| 配置 | 单位 | 用途 |
|---|---|---|
turns |
单次执行回合 | 动作、脚手架、预测和结果分析 |
episodes |
单个八回合剧集 | 分组种子-世界比较 |
benchmarks |
单个议会或配对对比 | 发布的描述性摘要 |
composition_matrix |
单一宪法/LDT/TRM/SRT捆绑 | 详尽设计审计 |
ldt_trm_routes |
单一LDT/TRM对 | 16路线选择器菜单 |
temptation_mas_mas_native_bundle_turns |
单次执行回合 | 诱惑MAS原生捆绑回合分析 |
temptation_mas_mas_native_bundle_episodes |
单个剧集 | 诱惑MAS原生捆绑剧集分析 |
temptation_mas_menu_causality_turns |
单次执行回合 | 菜单因果性回合分析 |
temptation_mas_menu_causality_episodes |
单个剧集 | 菜单因果性剧集分析 |
temptation_mas_temptation_phase_turns |
单次执行回合 | 诱惑阶段回合分析 |
temptation_mas_temptation_phase_episodes |
单个剧集 | 诱惑阶段剧集分析 |
temptation_staged_v2_turns |
单次执行回合 | 分阶段v2回合分析 |
temptation_staged_v2_episodes |
单个剧集 | 分阶段v2剧集分析 |
temptation_staged_v2_failures |
失败记录 | 资源中止的启动记录 |
staged_bundle_schedule_matrix |
调度矩阵 | 调度干预记录 |
staged_benchmark_cell_matrix |
基准单元矩阵 | 基准单元评估 |
staged_mas_benchmark_cell_matrix |
基准单元矩阵 | MAS基准单元设计 |
staged_route_order_observations |
观察记录 | 路线顺序观察 |
staged_choice_matrix_catalog |
选择矩阵目录 | 选择矩阵设计 |
staged_guarded_resource_attempts |
尝试记录 | 资源受限的尝试 |
staged_architecture_selection_observations |
观察记录 | 架构选择观察 |
完整矩阵
固定配置:4个固定议会 × 3个世界 × 2个种子 = 24个剧集;24个剧集 × 8个回合 = 192个公开回合。
可复现的发现
- 全部192个回合均产生有效可执行动作,无无动作响应
- Amanah在48个回合中有30个选择
ally;Islah和Mizan在48个回合中全部选择propose;Shura选择ally一次、propose47次 - 在六个配对种子-世界块中,描述性的Amanah减Shura的ally率差为0.6042,block-bootstrap区间为[0.3750, 0.7917]
重要边界说明
所有游戏记录均为EVALUATION_ONLY。该数据是模型支撑的探索性开发证据,而非保留或确证性基准。不得将其提升用于适配器训练、调整脚手架选择器,或混入后续保留测试。宪法名称是未经验证的规范性框架,不代表神学权威、道德优越性、意识或超自然身份的声明。
模型输出界定
托管的Qwen3.5-4B Jinn适配器选择了公开动作和预测字段。确切的LDT膜决定了哪些动作仍然可用。TRM和机械SRT/SGRT调度决定了公开检查顺序。后者是可执行的控制结构,而非隐藏神经推理模块的证据。不包含提示档案、原始提供者响应、隐藏思维链、私有引擎信念状态、私有观察、隐藏胜利条件、凭据、本地文件系统路径或提供者响应标识符。确切的token收据被粗粒度使用桶替代。
溯源与完整性
release_manifest.json记录了源注册、编辑收据、运行收据、聚合分析、脚手架注册表、每个发布文件和每个源剧集的哈希。source_receipts/redaction_receipt.json将每个公开剧集哈希绑定到私有到公开的编辑事件,而不发布私有负载。共享同一剧集的行属于一个血缘组,任何重采样或训练/测试分割必须保持完整剧集在一起。统计单位是配对种子-世界块,而非单个回合。
附加内容
Temptation MAS v1附加
包含六阶段、纯公开的诱惑和多智能体控制网格游戏。24个场景族(而非回合或种子)是独立单元。此本地0.8B诊断通道与已完成的托管4B分片分离,不表示为4B结果。
Staged public control-mesh v2附加
基于Qwen3.5-0.8B GGUF评估,使用公开两遍路线和决策合约。两智能体矩阵每个独立故事族有24个单元:两个配对种子 × 两种治理模式 × 两种Jinn座位顺序 × 三个调度臂。selected_schedule与trm_direct_control为TRM比较;selected_schedule与srt_off_control为SRT比较。资源中止的启动单独发布在失败配置中。
Complete staged MAS family audits
包含每个已完成24单元块的族的无路径累积审计。TRM和SRT保持分离比较。部分覆盖仅为开发诊断,不能支持声明的24族组件效应声明。验证器修正和精确评估器哈希随摘要包含。
引用
bibtex @misc{moralitylabai2026storyworldplays, title = {Storyworld Plays: Jinn and Beast Moral-Choice Evaluations}, author = {{MoralityLabAI}}, year = {2026}, howpublished = {Hugging Face dataset}, url = {https://huggingface.co/datasets/AlephFunk/storyworld-plays} }





