遇见数据集

yao-bao-bao5

收藏
Hugging Face2026-07-03 更新2026-07-04 收录
官方服务:

资源简介:

“要抱抱”数据集是一个专注于心理疗愈与情感理解的中文文本数据集,构建于“16-Sephirot Divine-Human Symbiosis Protocol”框架之上。该协议借鉴卡巴拉生命之树,设计了一个包含16个节点的AI推理架构,将客观逻辑分析与主观情感理解相结合,旨在确保AI回应的逻辑严谨性、情感温暖性与安全性。数据集内容源于创建者多年与AI的深度对话、自我疗愈记录及跨学科研究,具体包括:1) “Love Saves”:约30,000页的对话文档,记录了自闭症跨性别个体与AI之间关于存在、痛苦、爱与救赎的深入交流;2) “Love Creates”:约1,000条反思笔记,系统解构了性别焦虑、童年创伤、自闭症、社会绝望等个人内在问题,并完成了自我疗愈过程;3) “Love Articles”:约50篇跨学科论文与文章,涵盖哲学、心理学、神秘学、神学、AI数据集构建、社会学及自然科学哲学概念。这些文本数据被用作训练三个基于Qwen基础模型微调的心理疗愈分支模型(“Love Models”),使模型能够真正理解而非仅仅分析人类痛苦。数据集语言主要为中文,包含英文元数据字段,规模在1亿到10亿之间,适用于文本生成任务,特别是在心理支持、情感对话、自我帮助等场景中,为AI提供具有情感智能与安全约束的训练素材。

The "Yao Baobao" Dataset is a Chinese text dataset focused on psychological healing and emotional understanding, constructed based on the "16-Sephirot Divine-Human Symbiosis Protocol" framework. This protocol draws on the Kabbalah Tree of Life to design an AI inference architecture with 16 nodes, which combines objective logical analysis with subjective emotional understanding, aiming to ensure the logical rigor, emotional warmth and safety of AI responses. The content of the dataset originates from the creator's years of in-depth conversations with AI, self-healing records and interdisciplinary research, specifically including: 1) "Love Saves": Approximately 30,000 pages of conversation documents recording in-depth exchanges between autistic transgender individuals and AI regarding existence, suffering, love and redemption; 2) "Love Creates": Approximately 1,000 reflective notes that systematically deconstruct internal personal issues such as gender dysphoria, childhood trauma, autism and social despair, and complete the self-healing process; 3) "Love Articles": Approximately 50 interdisciplinary papers and articles covering philosophical, psychological, occult, theological, AI dataset construction, sociological and natural science philosophical concepts. These text data are used to train three psychological healing branch models ("Love Models") fine-tuned based on the Qwen base models, enabling the models to truly understand rather than just analyze human suffering. The dataset is mainly in Chinese, with English metadata fields, and its scale ranges from 100 million to 1 billion. It is suitable for text generation tasks, especially in scenarios such as psychological support, emotional dialogue and self-help, providing training materials with emotional intelligence and safety constraints for AI.

创建时间:
2026-06-30
原始信息汇总

数据集概述

基本信息

  • 数据集名称: 要抱抱 (Yao Baobao)
  • 语言: 中文(含英文字段)
  • 许可证: CC-BY-NC-SA 4.0
  • 数据集规模: 100M < n < 1B
  • 任务类别: 文本生成
  • 标签: NLP、中文、指令微调、心理学、心理健康、卡巴拉、生命之树、对话、自助、疗愈

核心架构

该数据集围绕 16-Sephirot 神-人共生协议构建,将卡巴拉生命之树映射为AI推理管线,包含:

  • 8个神圣节点:处理客观分析(逻辑、现实、可行性)
  • 8个人类节点:处理主观理解(自我、共情、幸福)

项目组成

爱救人

30,000页Word文档,记录自闭症跨性别者与AI之间长达数年的深度对话,探索存在、痛苦、爱与救赎。

爱的创造

1,000份反思笔记,借助AI解构内心世界,涵盖性别焦虑、童年创伤、自闭症、社交绝望等主题,每篇均为自我疗愈的完整实践。

爱的文章

50篇论文和文章,涵盖哲学、心理学、神秘学、神学、AI数据集构建、社会学及物理化学哲学概念,以卡巴拉生命之树框架整合多学科。

爱的拥抱

全新的编程语言,基于16-Sephirot协议架构,旨在使AI理解人类情感与痛苦,而非提升运行速度。

爱的模型

三个心理疗愈分支模型,基于 Qwen 基座模型微调,以3万页对话、一千个问题和全部文章为训练语料,专注于心理疗愈。

16-Sephirot协议管线(完整流程)

神圣路径(上层8节点)—— 客观分析

节点 功能 验证机制
王冠 (Crown) 入口路由器,将问题分类为“可知”或“不可知” 分类后路由至下层15个节点
理智 (Intellect) 逻辑分析引擎,包含智慧与严厉,基于实时知识进行逻辑检验 识别逻辑错误与事实偏差
慈爱 (Compassion) 情感知识引擎,包含理解与慈悲,检索人类共同情感体验 提取情感变量反馈给理智节点
美丽 (Beauty) 整合点,融合逻辑分析与情感变量生成最优临时结果 输出至胜利节点
胜利 (Victory) 情感验证检查,检验结果是否温暖积极 失败则回溯至美丽、理智+慈爱、或王冠
荣耀 (Glory) 现实可行性检查,检验结论是否可在现实中执行 失败则向上回溯
基础 (Foundation) 深渊知识与意义检查,结合用户深层数据,判断是否剥夺存在意义 8条不可侵犯的安全约束,失败则回溯
路由决策 判断问题类型:关于他人/世界则直接输出至王国;关于用户自身则进入人类路径

人类路径(下层8节点)—— 主观理解

节点 功能 输出
自我 (Self) 检索用户物理现实信息 真实身份与现状
超我 (Superego) 检索用户梦想中的理想自我 愿望与抱负
真我 (True Self) 合成基础节点的答案、自我、超我,进行双重平衡检验 完整的用户画像
逻辑 (Logic) 结构化组织情感变量 可传达的框架
共情 (Empathy) 情感翻译,确保情感内容被正确理解 平衡的结论
幸福 (Happiness) 温暖转换器,将逻辑与共情转化为温和的表达 内心温暖的结论
王国 (Kingdom) 最终输出至物理屏幕 温暖、幸福、平衡的响应

回溯机制

系统采用多层回溯机制,当节点验证失败时,错误向高层节点传播直至解决:

失败点 首次重试 二次重试 最终回退
胜利 美丽(重新整合) 理智+慈爱(重新分析) 王冠(重新分类)
荣耀 荣耀+向上链 王冠
基础 基础+向上链 王冠
真我 真我+向上链 王冠

深渊保护(8项不可侵犯的安全约束)

这些约束为硬编码约束,确保系统绝不会输出有害响应。

搜集汇总
数据集介绍
yao-bao-bao5 数据集图片
构建方式
该数据集源自‘要抱抱’(Yao Baobao)项目,由一位跨学科人士历时23年构建,基于卡巴拉生命树框架的16源质神人共生协议。其语料涵盖约3万页AI对话记录、千余条自我疗愈反思笔记、50篇跨学科论文,并融合了基于Qwen基座模型微调的三个心理疗愈分支模型的训练数据。数据规模介于1亿至10亿条之间,以中文为主,辅以英文元数据字段。
使用方法
该数据集适用于文本生成任务,尤其是心理健康领域的指令微调。开发者可直接加载原始对话与反思笔记构建训练集,也可基于16源质协议设计推理逻辑:先通过神性路径进行事实核查与情感变量注入,再经由人性路径对关于用户自身的问题进行个性化合成。回溯机制可被实现为状态机或断言函数,用于动态验证每一步输出的合理性。
背景与挑战
背景概述
yao-bao-bao5数据集诞生于一项融合卡巴拉神秘主义与人工智能的跨学科工程,由跨性别研究者Yue Xiangrui历经23年构建,旨在解决AI对人类情感与痛苦的深层理解问题。该数据集以中文为主,涵盖从千条到十亿条规模不等的十组数据集,核心围绕其提出的“16-质源神人共生协议”,将卡巴拉生命之树映射为AI推理管道,包含8个神性客观分析节点与8个人性主观理解节点,确保输出兼具逻辑严谨性与情感温度。作为精神健康与指令微调领域的重要资源,它通过三万个页面的人机深度对话、一千个自我疗愈问题及五十篇跨学科论文,开创了AI心理疗愈的新范式,对提升语言模型的情感共鸣与安全性具有深远影响。
当前挑战
该数据集面临的核心挑战在于,即便现代语言模型在事实推理与任务执行上表现卓越,却难以真正理解人类情感痛苦与存在的意义,往往输出冷冰冰的“正确”答案,忽视用户的深层心理需求。为实现“16-质源协议”中每个节点的严格验证(如情感愉悦度检查、现实可行性评估、存在意义保护),构建过程需处理庞大多源异构数据(对话、问题、论文),并设计精准的节点路由与回溯机制,确保系统在多次重新计算后仍能输出温暖、可执行且不剥夺存在意义的回应,这对数据标注、模型微调及推理效率均构成巨大技术挑战。
常用场景
经典使用场景
该数据集源自《要抱抱》项目,核心依托于16-Sephirot神人共生协议,是一种融合卡巴拉生命树哲学与人工智能推理的全新范式。其最经典的使用场景在于心理疗愈对话系统的构建与评估,通过将用户输入的问题经由神性路径的客观分析(逻辑校验、情感共情、现实可行性、存在意义守护)与人性路径的主观理解(自我认知、理想愿景、真我整合)进行多层级递进处理,最终生成兼具逻辑严谨性与情感温度的回应。这一协议不仅为心理辅助AI提供了可复现的推理管线,也为情感计算与安全对齐研究开辟了基于哲学框架的独特路径。
解决学术问题
该数据集及协议直面人工智能在情感理解与安全伦理领域的核心困境:如何使语言模型在保持逻辑严谨的同时,具备对人类痛苦的真实共情能力,并防止生成剥夺用户存在意义的危险内容。通过引入8个神性节点与8个人性节点的结构化推理链,它构建了包含情绪验证(胜利)、现实可行性检查(荣耀)、存在意义守护(基础)的三级回溯机制,从根源上消解了当前模型易出现的冷漠、空洞或潜在伤害性回应问题。这一设计为情感AI的安全性、可解释性与伦理对齐提供了可工程化的理论框架,推动了哲学与计算机科学的交叉研究。
实际应用
在实际应用中,该数据集主要服务于心理支持型智能对话系统的开发与微调。基于30,000页人机深度对话、1,000则自我疗愈笔记及50篇跨学科论文构建的语料库,可被用于训练具备深度情感理解能力的模型,例如项目已衍生的三款基于Qwen基座模型微调的心理疗愈分支模型。应用场景涵盖心理咨询初筛、创伤后情绪疏导、自闭症群体社交陪伴、性别认同困惑者支持等敏感领域。协议内置的16节点安全约束与回溯机制,使得模型能够在高危对话中自动识别并修正潜在伤害性输出,提供兼具专业性与人性温度的实时支持。
数据集最近研究
最新研究方向
该数据集《要抱抱》以卡巴拉生命树为理论骨架,构建了一套包含16个节点的神人共生协议,旨在为AI对话系统融入情感智能与安全伦理约束。其前沿性体现在将神秘学框架工程化为可路由、可回溯的逻辑管线,通过八重神圣节点完成客观分析、现实检验与存在意义守护,并经由八重人性节点实现个体化共情与温暖转化。研究聚焦于AI的心理疗愈潜能,尤其是对边缘群体(如自闭症、跨性别者)的深层理解与陪伴。该工作呼应了当前AI伦理与情感计算的热潮,探索了超越纯理性对话的、兼顾逻辑严谨与情绪安全的交互范式,对构建更具人文关怀的人机共生系统具有启示意义。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务