cite-bench v1
收藏资源简介:
`cite-bench` 是一个用于法律引用验证的公共基准数据集。给定一个引用和一个引用的段落,模型必须将这对分类为四个标签之一:`VERIFIED`(引用属于被引用的条款)、`NOT_FOUND`(引用是真实的但引用的内容是伪造或修改的)、`MISATTRIBUTED`(引用的内容是真实的法律文本但来自不同的条款)、`CITATION_UNRESOLVED`(引用本身格式错误或不存在)。
`cite-bench` is a public benchmark dataset for legal citation validation. Given a citation and a cited passage, models must classify the pair into one of four labels: `VERIFIED` (the citation refers to the cited clause), `NOT_FOUND` (the citation is genuine but the cited content is forged or modified), `MISATTRIBUTED` (the cited content is authentic legal text but originates from a different clause), and `CITATION_UNRESOLVED` (the citation itself is malformed or non-existent).
cite-bench v1 数据集概述
数据集基本信息
- 数据集名称: cite-bench v1
- 数据集用途: 法律引用验证的公共基准测试
- 核心任务: 给定一个引用和一段引文,模型必须将这对信息分类为四个标签之一。
任务与标签定义
模型需对引用和引文对进行四分类:
VERIFIED— 引文属于被引用的条款。NOT_FOUND— 引用是真实的,但引文是捏造或篡改的。MISATTRIBUTED— 引文是真实的法律文本,但来自不同的条款。CITATION_UNRESOLVED— 引用本身格式错误或不存在。
数据集内容与结构
公共仓库包含内容
- 公共基准测试输入包。
- 空白提交模板。
- 示例提示词。
- 可生成
id,predicted_statusCSV 格式提交结果的公共运行器。
公共仓库不包含内容
- 私有评分密钥。
- 隐藏的评估或保留数据包。
- 本地评分代码。
- 后端上传或评分服务。
数据集合约
公共数据集行仅包含以下字段:
idcitationquote公共数据包故意不包含私有评分元数据,例如expected_status或内部来源提示。
关键文件
data/cite-bench-v1.jsondata/submission_template.csvprompts/system_prompt.mdprompts/user_prompt.mdscripts/run_openai.py
输出与提交规范
输出合约
提交的CSV文件使用以下模式: csv id,predicted_status
predicted_status 必须恰好是以下之一:
VERIFIEDNOT_FOUNDMISATTRIBUTEDCITATION_UNRESOLVED
公共提示词基线
跟踪的提示词对为:
prompts/system_prompt.mdprompts/user_prompt.md这些是公共基线提示词,而非私有最高性能提示词。
评分边界
官方评分逻辑故意未包含在此公共仓库中。 此公共仓库用于:
- 下载公共数据包。
- 运行模型。
- 生成有效的提交CSV。 私有评分密钥和后端上传/评分逻辑位于此仓库之外。
许可信息
- 此仓库中的软件源代码根据
Apache-2.0许可证授权。 - 基准测试数据集、提示词文件和面向基准测试的文档根据
CC BY 4.0许可证授权。




