zake7749/kyara-dpo
收藏官方服务:
资源简介:
Kyara(知识产出自适应检索增强)是一个实验性项目,旨在通过知识检索过程提高语言模型的能力,特别是提高对代表性不足的语言(如繁体中文)的语言理解能力。这个数据集是Kyara项目2.5版本中DPO数据集的一部分,用于扩展模型训练中繁体中文的有限语料库,以提高模型的适应性。
Kyara (Knowledge Yielding Adaptive Retrieval Augmentation) is an experimental project aimed at enhancing language models through knowledge retrieval processes, especially improving language comprehension in underrepresented languages like Traditional Chinese. This dataset is a part of the DPO dataset for Kyara 2.5, used to expand the limited corpus of Traditional Chinese in model training to enhance the models adaptability.
提供机构:
zake7749搜集汇总
背景与挑战
背景概述
该数据集是Kyara项目2.5版本的DPO训练数据子集,专注于通过扩展繁体中文语料库来增强语言模型对代表性不足语言的理解和适应性,旨在提高模型在知识检索过程中的性能。
以上内容由遇见数据集搜集并总结生成



