登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Cohen’s d-values of chatbot comparisons of Baby-Centered Questions’.
Cohen’s d-values of chatbot comparisons of Baby-Centered Questions’.
收藏
Figshare
2025-03-17 更新
2026-04-28 收录
对话评估
婴儿护理问答
数据链接:
https://figshare.com/articles/dataset/Cohen_s_d-values_of_chatbot_comparisons_of_Baby-Centered_Questions_/28609549
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Cohen’s d-values of chatbot comparisons of Baby-Centered Questions’.
应用场景:
创建时间:
2025-03-17
相关数据集
geoskyr/multichallenge
多轮对话理解
对话评估
--- dataset_info: features: - name: QUESTION_ID dtype: string - name: AXIS dtype: string - name: CONVERSATION list: - name: role dtype: string - name: content d
Hugging Face
2026-04-24 更新
13
0
model2-test-results
对话评估
文本生成质量
该数据集包含3155个训练样本,总大小约20.1MB。每个样本由7个字段组成:system(字符串,系统指令)、user(字符串,用户输入)、gold_response(字符串,标准回答)、generated(字符串,生成内容)以及rouge1/rouge2/rougeL(浮点数,ROUGE评估分数)。数据集仅提供训练集划分,未说明具体应用场景或数据来源,但从字段命名推断可能用于对话系统响应生成的
Hugging Face
2026-04-18 更新
8
0
DCAgent2/dev_set_v2_allenai_sera_unified_31600_opt100k__Qwen3_8B_20260408_185423
对话评估
语言模型测试
--- dataset_info: features: - name: conversations list: - name: content dtype: string - name: role dtype: string - name: agent dtype: string - name: model dtype
Hugging Face
2026-04-09 更新
5
0
LUFY-Dataset
聊天机器人
对话评估
该数据集名为LUFY-Dataset,包含了从用户实验中收集的对话,这些实验涉及三种类型的RAG聊天机器人:原始RAG、MemoryBank和LUFY。数据集包括参与者创建的612个问答对,这些问答对根据记忆的重要性进行了标注。此外,该数据集为长期对话交流提供了基准,并通过主观和自动化的方法评估用户体验。规模上,数据涵盖了17名参与者在4天内进行的10个会话的数据。该数据集的任务是评估RAG聊天机
arXiv
10
0
USR-TopicalChat
对话评估
自然语言处理指标
收集该数据集的目的是评估对话评估指标。在论文 USR: An Unsupervised and Reference Free Evaluation Metric for Dialog (Mehri and Eskenazi, 2020) 中,作者收集了这些数据来衡量几个现有的基于词重叠和嵌入的指标的质量,以及他们新提出的USR 指标。
OpenXLab
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广