登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TheLumos/MedicalMistakeBenchmark
TheLumos/MedicalMistakeBenchmark
收藏
Hugging Face
2025-12-24 更新
2026-01-03 收录
数据链接:
https://hf-mirror.com/datasets/TheLumos/MedicalMistakeBenchmark
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-4.0 ---
许可证:知识共享署名4.0许可协议(CC BY 4.0)
应用场景:
提供机构:
TheLumos
相关数据集
TheLumos/MedPI-Dataset
医疗AI评估
对话系统
MedPI数据集是一个用于评估医疗AI模型在模拟的多轮面向患者的对话中的表现的数据集。它包含了7088个医疗对话,这些对话是AI模型(充当医生)与合成患者在多个专业领域的交流。每个对话根据MedPI评估框架中的105个维度进行评估,包括46个全局核心能力和59个特定会话能力。
Hugging Face
2025-12-17 更新
17
0
TheLumos/WHB_subset
女性健康
语言模型评估
WHB子集是一个精选的评估数据集,用于评估大型语言模型在女性健康相关任务中的表现。数据集包含模型桩(model stumps)和专家撰写的错误解释。这些模型桩代表了从患者面对的场景、临床决策背景和基于证据的医学问题中提取的现实提示。每个提示都配有专家解释,说明发现的问题。该子集来源于Women’s Health Benchmark (WHB),包含20个代表性的模型桩和对应的专家解释。数据集是与女
Hugging Face
2025-12-17 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广