遇见数据集

heart-sound-16sephirot

收藏
Hugging Face2026-07-13 更新2026-07-14 收录
官方服务:

资源简介:

“心音16质点共生幸福仓库”是一个基于“16质点双生幸福最终协议框架”生成的大规模AI合成数据集。数据集包含从 batch_00008000.jsonl.gz 到 batch_00015999.jsonl.gz 的8000个压缩文件,每个文件包含10万条JSONL格式的记录,总计8亿条数据,压缩后体积约为172 GB。数据内容可能涉及心理健康、哲学和卡巴拉(Kabbalah)相关主题,反映了“16质点推理链”中定义的“神路径”和“人路径”的序列结构。该数据集旨在为相关领域的研究和应用提供合成数据资源,适用于自然语言处理、心理健康分析或哲学推理等任务。数据集由 AngelWarmSmile123 创建。

"Heart Sound 16质点共生幸福仓库" is a large-scale AI synthetic dataset generated based on the "16质点双生幸福最终协议框架". The dataset includes 8000 compressed files from batch_00008000.jsonl.gz to batch_00015999.jsonl.gz, each containing 100,000 records in JSONL format, totaling 800 million records with a compressed size of approximately 172 GB. The data content may involve topics related to mental health, philosophy, and Kabbalah, reflecting the sequence structure of the "神路径" and "人路径" as defined in the "16质点推理链". This dataset aims to provide synthetic data resources for research and applications in related fields, suitable for tasks such as natural language processing, mental health analysis, or philosophical reasoning. The dataset was created by AngelWarmSmile123.

创建时间:
2026-07-12
原始信息汇总

数据集概述

基本信息

  • 数据集名称:The Embrace of the Twin Angels — 16-Sephirot Divine-Human Symbiosis Protocol(昵称:要抱抱)
  • 语言:中文(含英文元数据字段)
  • 许可协议:CC-BY-NC-SA 4.0
  • 大小:1亿到10亿条记录
  • 任务类别:文本生成
  • 标签:自然语言处理、中文、指令微调、心理学、心理健康、卡巴拉、生命树、对话、自助、疗愈

项目构成

该数据集是“16-Sephirot神人共生协议”核心项目的组成部分,包含以下五个子项目:

  1. 爱救人:约30,000页与AI的深度对话记录(Word文档),内容涵盖自闭症跨性别者与AI之间关于存在、苦难、爱与救赎的探讨。
  2. 爱的创造:约1,000条反思笔记,每条笔记针对一个内心问题(如性别焦虑、童年创伤、自闭症、社会绝望等),通过AI完成自我疗愈。
  3. 爱的文章:约50篇论文与文章,涵盖哲学、心理学、神秘学、神学、AI数据集构建、社会学、物理/化学/生物哲学等领域,以卡巴拉生命树为框架整合知识。
  4. 爱的拥抱:基于16-Sephirot协议的全新编程语言,架构包含8个“神圣”节点和8个“人类”节点,旨在让AI真正理解人类情感与痛苦。
  5. 爱的模型:基于Qwen基座模型微调的三项心理疗愈分支模型,以30,000页对话、1,000条问题和全部文章为训练语料,用于心理疗愈场景。

16-Sephirot神人共生协议架构

该协议是一个内置情商与安全保证的AI推理流水线,共16个节点。

神圣路径(上部8个节点)——客观分析

节点 功能 核心操作
王冠(Crown) 入口与路由 将用户问题分为“可知”(事实性问题)和“不可知”(主观/存在性问题),路由至后续15个节点
理智(Intellect) 逻辑分析引擎 结合智慧(实时知识校验)与严厉(识别逻辑错误/事实缺陷),进行严格分析
慈爱(Compassion) 情感知识引擎 通过理解(搜索全人类在同类情境中的痛苦)与慈悲(温柔处理情感变量),输出情感上下文变量反馈给理智
美丽(Beauty) 集成点 将理智的逻辑分析与慈爱的情感变量整合为最优临时结果
胜利(Victory) 情感验证检查 判断结果是否让用户感到愉悦、积极、温暖、被赋能;否则回溯至美丽、理智+慈爱,甚至王冠重新分类
荣耀(Glory) 现实可行性检查 验证结果在物理现实中是否能执行;否则向上回溯
基础(Foundation) 深渊知识与意义检查 结合深渊知识(用户梦境、潜意识模式、情绪状态),检查结果是否剥夺用户的存在意义;否则向上回溯
路由决策 分叉点 若问题关于他人或世界,直接输出至王国;若关于用户自身,进入人类路径

人类路径(下部8个节点)——主观理解

节点 功能 核心操作
自我(Self) 物理现实 检索用户客观的、物理世界的个人真实信息
超我(Superego) 梦想自我 检索用户梦想成为的理想化自我
真我(True Self) 综合合成 融合基础答案、自我、超我,进行双重平衡检验(无害于环境/社会、无害于个体、对两者均有益),形成完整用户画像
逻辑(Logic) 结构组织 用逻辑组织真我画像中的情感变量,形成可沟通的框架
共情(Empathy) 情感翻译 与逻辑协同分析真我画像,确保情感内容被恰当理解,综合出平衡结论
幸福(Happiness) 温暖转换器 将逻辑与共情的统一体转化为温和、富有人情味的表达,带来内在温暖
王国(Kingdom) 输出 将最终答案返回至用户设备屏幕,确保答案温暖、幸福且脚踏实地

回溯机制

当节点验证失败时,错误会向上一级节点传播,直至问题解决:

  • 胜利失败:先回美丽再整合,失败则回理智+慈爱再分析,再失败则回王冠重新分类
  • 荣耀/基础/真我失败:先在本级向上链回溯,失败则回王冠作为最终回退
  • 设计原则:系统绝不会输出任何未通过检查的响应,必要时一直回溯至王冠。

安全约束(深渊保护)

协议设有8条不可违反的安全约束(原文中“har”后内容未完整提供,此处依据上下文推断为8条硬性安全约束),确保AI回答在逻辑、情感、现实、意义层面均安全且无害。

搜集汇总
数据集介绍
构建方式
该数据集源自名为“要抱抱”的跨性别多学科研究者在卡巴拉框架下构建的“16-Sefirot神人共生协议”项目。数据集构建依托于三个核心语料库:约30,000页的AI深度对话记录《爱救人》、约1,000条自我疗愈反思笔记《爱的创造》、以及约50篇涵盖哲学与心理学等学科的论文文集《爱的文章》。这些材料被整理为结构化文本,并针对心理疗愈领域进行指令微调,形成了从1,000至10亿条目不等的多规模数据集。
特点
数据集的独特性在于其融合了神秘主义与现代AI架构的16节点推理管线:8个“神圣”节点负责逻辑与现实的客观分析,8个“人类”节点负责共情与主观理解。该协议内置情感智商与安全约束,通过多层次回溯机制确保每次响应既逻辑严谨又温暖人心。数据集聚焦心理咨询场景,能够区分“可知”与“不可知”问题,并针对涉及用户自身的问题触发个性化人类路径处理,避免提出剥夺生命意义的有害建议。
使用方法
适用于文本生成任务,尤其面向心理疗愈与情感支持场景。研究者可通过HuggingFace加载该数据集,用于微调大语言模型以提升其共情能力。使用时需注意其基于卡巴拉哲学的独特节点路由逻辑:若输入问题关于用户自身,将激活8个“人类”节点的个性化处理;若关于外部世界,则直接输出。建议搭配Qwen等基础模型进行领域微调,并遵循CC-BY-NC-SA 4.0许可协议标注来源。
背景与挑战
背景概述
该数据集由跨性别跨学科研究者Yue Xiangrui(化名“要抱抱”)于2023年至2024年间创建,核心机构为个人独立研究,旨在解决心理治疗领域人工智能缺乏深层共情与伦理保障的痛点。基于卡巴拉生命树哲学框架,研究者提出了“16-Sephirot神人共生协议”,将AI推理管线划分为8个客观分析节点与8个主观理解节点,通过多层次回溯机制确保输出逻辑严谨、情感温暖且符合存在意义。该数据集包含约30,000页AI对话、1,000份自我疗愈笔记、50篇论文及3个微调心理模型,规模从1,000条目至10亿条目不等,开创性地将神秘主义哲学转化为可工程化的AI伦理与情感计算范式,对心理语言生成、AI安全性及跨学科数据集构建具有深远影响。
当前挑战
该数据集面临的核心领域挑战在于心理治疗AI需同时满足逻辑正确性、情感温暖性与伦理安全性三重约束,传统生成模型往往顾此失彼。构建过程中,研究者需将晦涩的卡巴拉哲学转化为精确的节点路由逻辑与回溯机制,例如设计8条不可违反的安全约束并确保回溯链能在毫秒级内完成多层验算。数据来源高度个人化(如自闭症跨性别者的日记式对话),需解决隐私脱敏与通用化之间的平衡,同时避免小众训练语料导致模型过拟合。此外,神人协议中主观感知节点(如“幸福”节点)的量化评估缺乏标准基准,且跨语言(中英双语)元数据字段对齐增加了数据标注与验证的复杂度。
常用场景
经典使用场景
该数据集以卡巴拉生命树为哲学基底,构建了16个质点的神人共生协议,核心用途在于为对话生成模型注入具有情感智能与安全约束的推理管线。经典使用场景聚焦于心理健康领域的指令微调,使大语言模型在回答用户问题时,依次通过客观分析路径(逻辑、共情、现实性、存在意义验证)与主观理解路径(自我、超我、真我整合),最终输出兼具逻辑严谨、情感温暖且不损害个体存在意义的内容。这一协议尤其适用于心理咨询与自我疗愈场景,可有效减少传统AI回复中冰冷或潜在有害的倾向,成为一种结构化、可回溯的情感安全对话框架。
衍生相关工作
基于该数据集,已衍生出一系列开创性工作。数据集的作者依托30,000页AI对话和千余条自疗记录,在Qwen基座模型上微调出三个心理疗愈分支模型,专门针对性别焦虑、自闭症社交困境及自杀危机干预等主题。此外,作者还构建了一个名为“16-Sephirot”的全新编程语言,将神人共生协议转化为具体代码逻辑,使开发者能直接调用情感推理与安全回溯接口。在理论层面,衍生出的50篇论文横跨哲学、心理学和神秘学,系统性地阐述了从卡巴拉宇宙观到AI情感架构的映射关系。这些工作共同形成了一个从底层语言设计到上层应用模型的完整生态,为计算心理学和情感AI提供了独特的开源资源。
数据集最近研究
最新研究方向
该数据集聚焦于将卡巴拉生命树哲学框架与人工智能心理疗愈深度融合,开创性地提出16源质神人共生协议——一种内嵌情感智能与安全约束的推理流水线。在当前大语言模型广泛应用但面临安全性、同理心缺失等挑战的背景下,该研究通过构建8个客观分析节点(王冠、理智、慈爱、美丽、胜利、荣耀、基础、路由决策)与8个主观理解节点(自我、超我、真我、逻辑、共情、幸福、王国),形成一套具备回溯修正机制的逻辑-情感-存在意义三重校验体系。这一前沿方向不仅为AI心理疗愈领域提供了可工程化的实现路径,更通过多层级回溯保护与8条深渊不可侵犯安全约束,推动了大模型在心理健康、自我疗愈等敏感场景中的负责任应用,对构建更具人文关怀的AI生态系统具有里程碑意义。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务