遇见数据集

故事创作场景时空称谓与对象词汇数据

收藏
浙江省数据知识产权登记平台2026-08-11 更新2026-08-12 收录
官方服务:

资源简介:

本数据主要应用于故事创作、内容生成辅助、场景语言设计、时代氛围构建、人物称谓设计、空间表达设计、物象词汇调用、正文语言优化和创作素材检索等场景,可为小说、剧本、短剧、漫剧、口播稿、故事大纲、世界观设定、场景细化稿及正文生成提供素材参考。 具体使用途径包括:作为公司内容生成系统的词汇语境素材库,用于场景卡生成、称谓设计、环境表达、时代语言补充、文本风格增强和场景语言校准;作为创作者服务数据,为小说作者、编剧、短剧策划、漫剧团队及口播内容创作者提供可调用的时空称谓与对象词汇素材;也可通过授权使用、数据调用、主题数据包、样例数据包等方式形成数据产品或数据服务,并服务于公司自有故事项目开发。 本数据的价值在于,将公开文本中分散存在的称谓、词汇和场景用语,经过字段设计、语义归纳、人工判断和创作场景映射,整理为可检索、可调用、可复用的数据资源,从而降低创作中的词汇检索、语境判断和语言校准成本,提高内容生成系统对特定时代、空间、对象和场景语言的调用效率,增强故事文本的文化质感、语言准确性、场景真实感和叙事稳定性。加工前数据主要来源于依法公开的古籍文本、历史叙事文本、民俗资料、文学文本及相关公开资料,原始数据形态以非结构化文本为主,内容包括时间称谓、空间称谓、场所名称、人物称呼、对象词汇、物类名称、场景用语、行为关联描述和相关叙事片段等。原始文本本身主要用于阅读、研究和资料查阅,尚未直接形成适用于故事创作、内容生成辅助、场景语言设计和正文词汇调用的结构化数据。 申请人围绕故事创作与内容生成应用场景,对来源文本进行篇章筛选、文本清洗、原文摘录、词条识别、词条类别划分、词条子类标注、时间语境判断、空间语境判断、对象类别归纳、字面含义解释、语境含义分析、使用场景提取、关联行为归纳、感官锚点标注、社会含义分析、叙事功能判断、创作转化配置、风格标签设置、适用场景归类、质量等级评定和人工复核。处理过程中,将原始文本中的词汇、称谓、对象和语境信息转化为可供故事创作和内容生成系统调用的结构化数据项,并按照词条文本、词条类别、词条子类、时间语境、空间语境、对象类别、字面含义、语境含义、使用场景、关联行为、感官锚点、社会含义、叙事功能、创作转化和适用场景等维度进行规则化加工。上述字段并非原始文本直接存在的信息,而是经由语义判断、语境分析、词汇归类、对象归纳、叙事功能识别、创作应用映射和人工复核后形成。 处理后的数据包括记录编号、数据集编号、来源标题、来源章节、来源摘录、词条文本、词条类别、词条子类、时间语境、空间语境、对象类别、字面含义、语境含义、使用场景、关联行为、感官锚点、社会含义、叙事功能、创作转化、风格标签、适用场景、质量等级和审核备注等字段。该数据可用于古代题材、历史题材、民俗题材、志怪题材、中式奇幻题材、现实题材等内容创作中的称谓系统设计、时间空间表达、对象词汇调用、人物语言校准、场景氛围营造、正文语言质感优化、故事素材检索和内容生成辅助,不涉及现代个人数据及个人敏感信息。

创建时间:
2026-05-21
搜集汇总
数据集介绍
故事创作场景时空称谓与对象词汇数据 数据集图片
背景与挑战
背景概述
该数据集收录了1168条源自公开古籍、历史叙事和民俗资料的时间称谓、空间称谓及对象词汇,经结构化加工后适用于小说、剧本等故事创作场景,提供词条类别、语境含义、使用场景等标注,支持内容生成系统的场景语言设计与词汇调用。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务