遇见数据集

Salesforce/FaithEval-inconsistent-v1.0

收藏
Hugging Face2025-02-01 更新2025-04-08 收录
官方服务:

资源简介:

FaithEval是一个致力于评估大型语言模型(LLM)在处理三种不同上下文任务时的上下文忠实性的全面基准。这三种任务包括无法回答、上下文不一致和反事实上下文。

FaithEval is a comprehensive benchmark dedicated to evaluating the contextual faithfulness of large language models (LLMs) across three diverse tasks: unanswerable, inconsistent, and counterfactual contexts.

提供机构:
Salesforce
二维码
社区交流群
二维码
科研交流群
商业服务