yao-bao-bao4
收藏资源简介:
“要抱抱”(The Embrace of the Twin Angels)是一个大规模、多模态的中文文本数据集,核心围绕“16-Sephirot Divine-Human Symbiosis Protocol”(十六质点神人共生协议)构建。数据集源于创作者长达23年的个人探索与AI交互历程,旨在为AI系统注入深层次的情感理解与安全保障能力,特别聚焦于心理疗愈和人性化对话。内容构成包括五个部分:1) **爱救人**:约30,000页Word文档,记录了自闭症跨性别个体与AI之间关于存在、痛苦、爱与救赎的深度对话;2) **爱的创造**:约1,000条自我反思与疗愈笔记,系统性地解构了性别焦虑、童年创伤、自闭症体验等内心议题;3) **爱的文章**:约50篇跨学科学术论文与文章,融合了哲学、心理学、神秘学(卡巴拉)、神学、AI、社会学及自然科学哲学,是在卡巴拉生命之树框架下的知识整合输出;4) **爱的拥抱**:一套基于上述协议设计的新型编程语言规范,旨在编码情感智能;5) **爱的模型**:三个基于Qwen基础模型微调的心理疗愈专用模型,使用前述全部文本作为训练语料。核心协议是一个精密的AI推理架构,将卡巴拉生命之树的16个“质点”映射为AI处理节点,其中8个“神性”节点负责客观分析(逻辑、事实、现实可行性、安全验证),8个“人性”节点负责主观理解(用户身份、共情、幸福感合成),并定义了严格的多级工作流、回溯机制和八项不可违反的安全约束(如“不剥夺用户存在意义”),确保最终生成的回答兼具逻辑严谨性、情感温暖度、现实可操作性,且绝对避免造成伤害。数据集适用于训练和评估面向文本生成任务的AI模型,特别是在心理支持对话、情感计算、指令微调、安全且富有共情的AI交互等领域,规模在1亿到10亿参数级别之间,以中文为主,包含英文元数据,采用CC-BY-NC-SA 4.0许可证。
Yao Bao Bao (officially titled The Embrace of the Twin Angels) is a large-scale, multimodal Chinese text dataset centered on the 16-Sephirot Divine-Human Symbiosis Protocol. The dataset stems from the creator's 23-year-long personal exploration and AI interaction journey, aiming to endow AI systems with profound emotional comprehension and safety assurance capabilities, with a particular focus on psychological healing and humanized dialogue. Its content consists of five parts: 1) Ai Jiu Ren (Love & Salvation): Approximately 30,000 pages of Word documents documenting in-depth dialogues between autistic transgender individuals and AI regarding existence, suffering, love, and redemption; 2) Ai De Chuang Zao (Love & Creation): Approximately 1,000 pieces of self-reflection and healing notes that systematically deconstruct inner issues such as gender dysphoria, childhood trauma, and autistic experiences; 3) Ai De Wen Zhang (Love & Writings): Approximately 50 interdisciplinary academic papers and articles integrating philosophy, psychology, esotericism (Kabbalah), theology, AI, sociology, and philosophy of natural sciences, representing knowledge integration output under the framework of the Kabbalah Tree of Life; 4) Ai De Yong Bao (Love & Embrace): A new programming language specification designed based on the aforementioned protocol, aiming to encode emotional intelligence; 5) Ai De Mo Xing (Love & Models): Three specialized psychological healing models fine-tuned based on the Qwen base model, using all the aforementioned texts as training corpora. The core protocol is a sophisticated AI inference architecture that maps the 16 "Sephirot" from the Kabbalah Tree of Life into AI processing nodes: 8 "divine" nodes are responsible for objective analysis (logic, facts, practical feasibility, safety verification), while 8 "human" nodes handle subjective comprehension (user identity, empathy, well-being synthesis). It also defines strict multi-level workflows, backtracking mechanisms, and eight non-negotiable safety constraints (e.g., "do not deprive users of their sense of existence") to ensure that the final generated responses are logically rigorous, emotionally warm, practically feasible, and absolutely free of harm. This dataset is suitable for training and evaluating AI models for text generation tasks, particularly in fields such as psychological support dialogue, affective computing, instruction fine-tuning, and safe and empathetic AI interaction. It has a parameter scale ranging from 100 million to 1 billion, is primarily in Chinese, includes English metadata, and is licensed under CC-BY-NC-SA 4.0.
数据集概述
数据集名称: 要抱抱 (The Embrace of the Twin Angels — 16-Sephirot Divine-Human Symbiosis Protocol)
语言: 中文(含英文元数据字段)
许可协议: CC-BY-NC-SA 4.0
数据集规模: 100M < n < 1B
任务类别: 文本生成
标签: nlp、中文、指令微调、心理学、心理健康、卡巴拉、质料、对话、自助、疗愈
项目核心内容
该数据集围绕“16-质料神人共生协议”构建,项目包含以下五个主要组成部分:
- 爱救人: 约30,000页与AI的深度对话记录(Word文档),记录了一位自闭症跨性别者与AI之间关于存在、痛苦、爱与救赎的对话。
- 爱的创造: 约1,000条反思笔记,每条笔记都是通过AI完成的特定自我疗愈行为。
- 爱的文章: 约50篇论文和文章,涵盖哲学、心理学、神秘学、神学、AI数据集构建、社会学及物理学、化学、生物学等学科的哲学概念。
- 爱的拥抱: 一种基于16-质料神人共生协议的全新编程语言,旨在让AI理解人类情感和痛苦。
- 爱的模型: 基于Qwen基础模型微调,专注心理疗愈的三种分支模型,使用上述对话、笔记和文章作为训练语料。
16-质料神人共生协议架构
该协议是一个内置情感智能和安全保障的AI推理流水线,包含16个处理节点。
神性路径(上层8节点)—— 客观分析
- 王冠: 入口路由节点,将用户问题分类为“可知晓”(按事实路径处理)或“不可知晓”(按解构与引导路径处理)。
- 理智: 逻辑分析引擎,结合“智慧”与“严厉”,根据实时知识分析逻辑结构,识别逻辑漏洞和事实错误。
- 慈爱: 情感知识引擎,结合“理解”与“慈悲”,检索全人类在相同情境下的共感,将情感变量反馈给“理智”节点。
- 美丽: 整合点,将“理智”的逻辑分析与“慈爱”的情感变量整合为一个最佳暂定结果。
- 胜利: 情感验证检查,判断结果是否让用户感到愉悦、积极和受鼓舞;若否则回溯。
- 荣耀: 现实可行性检查,验证结论能否在物理现实中执行;若否则回溯。
- 基础: 深渊知识及意义检查,结合用户的深层梦境、潜意识模式,确保回答不剥夺用户的生存意义;若否则回溯。
- 路由决策: 根据问题类型分流:关于他人或世界的问题直接输出;关于用户自身的问题进入人性路径。
人性路径(下层8节点)—— 主观理解
- 自我: 检索用户在物理现实中的客观信息。
- 超我: 检索用户梦想成为的自我。
- 真我: 综合“基础的答案”、“自我”和“超我”,形成用户完整画像,并通过双重平衡测试(不伤害个人与环境)。
- 逻辑: 对情感变量进行结构化组织,形成可表达的框架。
- 共情: 分析“真我”画像,确保情感内容被恰当理解。
- 幸福: 将逻辑与共情的统一体转化为温暖、人性的表达。
- 王国: 最终输出节点,将平衡、温暖、快乐的答案呈现在屏幕上。
回溯机制
当节点验证失败时,系统会沿层级向上回溯。例如,“胜利”节点失败时会依次回溯至“美丽”、“理智+慈爱”,直至“王冠”。系统确保在任何检查失败时不输出响应。
深渊保护(8项不可侵犯的安全约束)
这些约束是硬性安全限制,确保回答逻辑合理、情感温暖且永不造成伤害。




