遇见数据集

umarbutler/better-cuad

收藏
Hugging Face2024-06-13 更新2024-06-15 收录
官方服务:

资源简介:

该数据集是Contract Understanding Atticus Dataset (CUAD)的改进版本,所有合同的全文和注释已合并到一个`jsonl`文件中,以便于使用Hugging Face 🤗 datasets库加载。

This dataset is an improved version of the Contract Understanding Atticus Dataset (CUAD). The full text and annotations of all contracts have been consolidated into a single `jsonl` file to facilitate loading via the Hugging Face 🤗 datasets library.

提供机构:
umarbutler
原始信息汇总

Better CUAD 📜

数据集概述

  • 许可证: cc-by-4.0
  • 语言: 英语
  • 标签: 法律, 合同
  • 标注创建者: 专家生成
  • 语言创建者: 发现
  • 数据集名称: Better CUAD
  • 数据集大小: n<1K
  • 源数据集: cuad
  • 任务类别: 文本分类, 标记分类, 问答, 文本生成, 填空
  • 任务ID: 多类分类, 多标签分类, 命名实体识别, 语言建模
  • Papers with Code ID: cuad
  • arXiv 编号: 2103.06268

数据集描述

该数据集保存了Contract Understanding Atticus Dataset (CUAD),其中所有合同的完整文本和标注已合并到一个jsonl文件中,以便于使用Hugging Face 🤗 datasets库加载。

搜集汇总
数据集介绍
umarbutler/better-cuad 数据集图片
背景与挑战
背景概述
Better CUAD是一个基于CUAD(Contract Understanding Atticus Dataset)的法律合同理解数据集,专注于英语合同文本的NLP任务,包括文本分类、令牌分类和问答。它包含510行数据,格式为json,由专家标注,覆盖多个法律条款的问答对,适用于合同自动审查和自然语言处理研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务