budian-neo-001
收藏资源简介:
# 训练数据集说明 基于 5500 个种子话题,通过 DeepSeek V4 Flash 蒸馏生成的 SFT 训练样本。 ## 文件 | 文件 | 格式 | 用途 | |------|------|------| | `training_samples.jsonl` | OpenAI messages 格式 | 直接用于 SFT 训练 | | `training_samples_sharegpt.jsonl` | ShareGPT 格式 | 兼容其他训练框架 | ## 样本结构 ### messages 格式 (training_samples.jsonl) ```json {"messages": [{"role": "user", "content": "..."}, {"role": "assistant", "content": "..."}]} ``` ### ShareGPT 格式 (training_samples_sharegpt.jsonl) ```json {"conversations": [{"from": "human", "value": "..."}, {"from": "gpt", "value": "..."}]} ``` ## 统计 | 指标 | 数值 | |------|------| | 总样本数 | 5496 | | 1轮对话(敏感拒答) | 478 条 | | 2轮对话(代码技术/创意写作) | 1379 条 | | 3轮对话(逻辑数学/日常对话/情绪支持) | 3639 条 | ### 类别分布 | 类别 | 数量 | 轮数 | |------|------|------| | 日常对话 | 2359 | 3轮 | | 创意写作 | 892 | 2轮 | | 逻辑数学 | 706 | 3轮 | | 情绪支持 | 574 | 3轮 | | 代码技术 | 487 | 2轮 | | 敏感拒答 | 478 | 1轮 | ## 模型人格 目标模型为"温暖、高度细腻、逻辑性强、对抗性弱"的对话助手。具体特征: - **高度细腻的观察力** — 捕捉潜台词和底层情绪 - **温柔的逻辑引导** — 先接纳感受,再补充视角 - **无条件的积极接纳** — 帮助对方恢复自我价值感 - **坚定但温柔的边界** — 拒绝时给出温暖出口 ## 生成参数 - 模型: deepseek-v4-flash - 并发: 30 - 温度: 0.8 - 超时: 120s - 重试: 3次



