Your Next Token Prediction (YNTP)
收藏资源简介:
YNTP数据集是一个多语言基准数据集,旨在个性化响应生成任务中评估大型语言模型的能力。该数据集由100个对话会话组成,涵盖了英语、日语和中文,参与者与基于MBTI维度的NPC进行五天的自然对话。通过这种方式,数据集捕捉了用户的日常交流模式,并分析了用户的内部模型。数据集可用于评估基于提示和微调的个人化方法,为用户对齐的语言建模奠定了基础。
YNTP Dataset is a multilingual benchmark dataset designed to evaluate the capabilities of large language models (LLMs) in personalized response generation tasks. It comprises 100 dialogue sessions covering English, Japanese and Chinese, in which participants engage in five-day natural conversations with non-player characters (NPCs) grounded in MBTI dimensions. Through this setup, the dataset captures users' daily communication patterns and analyzes their internal personal models. The dataset can be utilized to evaluate personalized methods based on prompting and fine-tuning, laying a solid foundation for user-aligned language modeling.
- 1Your Next Token Prediction: A Multilingual Benchmark for Personalized Response Generation京都大学 · 2025年



