umarbutler/better-cuad
收藏官方服务:
资源简介:
该数据集是Contract Understanding Atticus Dataset (CUAD)的改进版本,所有合同的全文和注释已合并到一个`jsonl`文件中,以便于使用Hugging Face 🤗 datasets库加载。
This dataset is an improved version of the Contract Understanding Atticus Dataset (CUAD). The full text and annotations of all contracts have been consolidated into a single `jsonl` file to facilitate loading via the Hugging Face 🤗 datasets library.
提供机构:
umarbutler原始信息汇总
Better CUAD 📜
数据集概述
- 许可证: cc-by-4.0
- 语言: 英语
- 标签: 法律, 合同
- 标注创建者: 专家生成
- 语言创建者: 发现
- 数据集名称: Better CUAD
- 数据集大小: n<1K
- 源数据集: cuad
- 任务类别: 文本分类, 标记分类, 问答, 文本生成, 填空
- 任务ID: 多类分类, 多标签分类, 命名实体识别, 语言建模
- Papers with Code ID: cuad
- arXiv 编号: 2103.06268
数据集描述
该数据集保存了Contract Understanding Atticus Dataset (CUAD),其中所有合同的完整文本和标注已合并到一个jsonl文件中,以便于使用Hugging Face 🤗 datasets库加载。
搜集汇总
数据集介绍

背景与挑战
背景概述
Better CUAD是一个基于CUAD(Contract Understanding Atticus Dataset)的法律合同理解数据集,专注于英语合同文本的NLP任务,包括文本分类、令牌分类和问答。它包含510行数据,格式为json,由专家标注,覆盖多个法律条款的问答对,适用于合同自动审查和自然语言处理研究。
以上内容由遇见数据集搜集并总结生成



