登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Average soft accuracy on metadata question answering datasets.
Average soft accuracy on metadata question answering datasets.
收藏
Figshare
2023-11-13 更新
2026-04-28 收录
元数据问答
医疗问答系统评估
数据链接:
https://figshare.com/articles/dataset/Average_soft_accuracy_on_metadata_question_answering_datasets_/24553966
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Average soft accuracy on metadata question answering datasets.
应用场景:
创建时间:
2023-11-13
相关数据集
RepLiQA
医疗问答系统评估
语言模型测试
RepLiQA是一个评估数据集,包含上下文-问题-答案三元组,上下文涉及虚构的实体,如人物或地点,不真实存在。该数据集旨在测试大型语言模型(LLMs)在提供文档中查找和使用上下文信息的能力。与现有问答数据集不同,RepLiQA的非事实性确保模型性能不受LLMs记忆训练数据中事实的能力影响,可以更自信地测试模型利用提供上下文的能力。数据集涵盖17个主题或文档类别,每个文档附带5个问题-答案对。此外,
github
2024-06-19 更新
32
1
IaraMed/KPE_results_v2
关键短语提取
医疗问答系统评估
该数据集包含一个问题(pergunta)和对应的答案(resposta),以及多个不同版本和大小(KPE_docs_v* 和 KPE_docs_v*_large)的文档字段。数据集划分为训练集,共有500个示例。
Hugging Face
2025-03-04 更新
12
0
relai-ai/rasa-reasoning
对话式AI推理
医疗问答系统评估
这是一个针对问题回答任务的英文数据集,由RELAI使用rasa数据源生成,遵循CC BY 4.0许可。数据集的详细描述在README文件中并未直接给出。
Hugging Face
2025-04-21 更新
9
0
lim4349/korquad
机器阅读理解
医疗问答系统评估
--- dataset_info: features: - name: title dtype: string - name: context dtype: string - name: question dtype: string - name: id dtype: string - name: answers struct:
Hugging Face
2023-01-03 更新
13
0
math-extraction-comp/allenai__Llama-3.1-Tulu-3-8B-SFT
医疗问答系统评估
模型性能比较
这是一个包含问题、答案、目标、预测以及其他评估分数字段的数据集,用于训练和评估模型。数据集分为训练集,共有1324个示例。
Hugging Face
2025-01-26 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广