遇见数据集

可控文本生成模型数据

收藏
官方服务:

资源简介:

可控文本生成模型数据主要面向流调报告文本生成领域相关研究,用于基于流调知识图谱的流调报告个性化生成。主要包括模型的配置文件、模型的状态参数、特殊标记映射、分词器配置、训练参数以及词汇表文件。这些文件共同构成了模型运行和部署的基础。数据量为62GB

提供机构:
清华大学
搜集汇总
数据集介绍
可控文本生成模型数据 数据集图片
背景与挑战
背景概述
该数据集面向流调报告文本生成领域,用于基于流调知识图谱的个性化报告生成,包含模型配置文件、参数、分词器配置等基础文件,总数据量约为62GB。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务