登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
EnokiQA
EnokiQA
收藏
NIAID Data Ecosystem
2026-05-10 收录
长文本问答
幻觉检测
数据链接:
https://doi.org/10.7910/DVN/6TN4ZM
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
A large-scale dataset for hallucination detection in long-form question answering.
应用场景:
创建时间:
2026-02-08
相关数据集
HaluMem
幻觉检测
记忆系统
HaluMem是第一个专门为记忆系统定制的操作级幻觉评估基准。它将记忆工作流程分解为三个基本操作:记忆提取(评估系统准确识别和存储对话会话中事实信息的能力)、记忆更新(评估系统在提供新信息时正确修改现有记忆的能力)和记忆问答(评估系统整合多个记忆过程生成无幻觉答案的端到端能力)。每个操作都包含精心设计的评估任务,以揭示记忆处理不同阶段的幻觉行为。
github
2025-10-27 更新
128
0
absinth
新闻摘要
幻觉检测
该数据集名为“absinth”,包含了德国新闻文章及其生成的摘要,这些摘要由人工标注以检测幻觉现象。该数据集由4,314个文章-摘要句子对组成,这些句子对被标注为忠实、内在或外在的幻觉。此外,该数据集还包括了12位母语为德语的标注者进行的手动标注,确保了高质量标注和标注者之间的一致性。规模上,数据集包含了4,314个文章-摘要对,其任务集中在新闻摘要中的幻觉检测。
arXiv
20
0
rafaelsandroni/hallucination_dataset_with_features
幻觉检测
自然语言处理
该数据集包含用户问题、文本片段、命题、标签等多个特征,以及不确定性、切线、熵等数值特征。数据集分为训练集,包含1500个样本,文件大小约为9.3MB。
Hugging Face
2024-07-03 更新
18
0
HalluMix Benchmark
幻觉检测
自然语言处理
HalluMix Benchmark是一个大规模、领域多样化的数据集,专门设计用于评估真实生成场景中的幻觉检测。该数据集包括来自多个任务的示例,包括摘要、问答和自然语言推理,并涵盖广泛的领域,如医疗保健、法律、科学和新闻。每个实例都包含一个多文档上下文和一个响应,以及二进制幻觉标签,指示响应是否忠实于提供的文档。数据集旨在反映现实世界的信息检索场景,并评估现有幻觉检测方法在不同任务、文档长度和输入
arXiv
2025-05-01 更新
40
0
Natural Hallucination Dataset - ACI-bench Clinical Note Hallucination Annotations
医学文本处理
幻觉检测
该存储库包含来自ACI-bench数据集的专家标注的幻觉标签,用于评估医学文本摘要中的幻觉检测。自然幻觉(NH)数据集包含临床摘要中幻觉的专家标注,重点关注ACI-bench临床对话集中的SOAP笔记。
github
2025-05-24 更新
20
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广