ljvmiranda921/gsd-smith-Arabic
收藏资源简介:
该数据集包含3771个训练示例,主要用于多轮对话或代理交互研究。每个示例包含唯一标识符(id)、初始提示(seed_prompt)、语言(language)、模型信息(model)、消息列表(messages,含角色和内容)、代理追踪记录(agent_trace,以JSON列表格式存储)、研究早期停止标志(research_early_stopping)和来源标识符(source_id)。数据集支持多语言交互分析,适用于对话系统、代理行为追踪和自然语言处理任务的研究与评估。
This dataset contains 3771 training examples, primarily designed for multi-turn dialogue or agent interaction research. Each example includes a unique identifier (id), seed prompt (seed_prompt), language (language), model information (model), a list of messages (with role and content fields), agent trace records (agent_trace stored as JSON lists), a research early stopping flag (research_early_stopping), and a source identifier (source_id). The dataset supports multilingual interaction analysis and is suitable for research and evaluation in dialogue systems, agent behavior tracking, and natural language processing tasks.




