可控文本生成模型数据
收藏国家基础学科公共科学数据中心2026-01-30 收录
官方服务:
资源简介:
可控文本生成模型数据主要面向流调报告文本生成领域相关研究,用于基于流调知识图谱的流调报告个性化生成。主要包括模型的配置文件、模型的状态参数、特殊标记映射、分词器配置、训练参数以及词汇表文件。这些文件共同构成了模型运行和部署的基础。数据量为62GB
提供机构:
清华大学搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集面向流调报告文本生成领域,用于基于流调知识图谱的个性化报告生成,包含模型配置文件、参数、分词器配置等基础文件,总数据量约为62GB。
以上内容由遇见数据集搜集并总结生成



