遇见数据集

Wexler/llawma-fact-enrich

收藏
Hugging Face2024-04-10 更新2024-06-11 收录
官方服务:

资源简介:

该数据集是从公共查询中提取的样本数据集,用于Wexler事实丰富任务。任务要求从文档中提取描述事实的源文本,并从中提取相关信息。数据集包含关于该事实的多个字段,如描述、主题、主体和事件日期。例如,给定一个描述事实的源文本,数据集会提取出该事实的描述、主题、主体和事件日期等信息。

该数据集是从公共查询中提取的样本数据集,用于Wexler事实丰富任务。任务要求从文档中提取描述事实的源文本,并从中提取相关信息。数据集包含关于该事实的多个字段,如描述、主题、主体和事件日期。例如,给定一个描述事实的源文本,数据集会提取出该事实的描述、主题、主体和事件日期等信息。

提供机构:
Wexler
原始信息汇总

数据集概述

基本信息

  • 许可证: cc-by-nc-nd-4.0
  • 任务类别: 特征提取
  • 语言: 英语
  • 标签: 法律
  • 数据集大小: 小于1K

数据内容

  • 来源: 公共查询样本
  • 任务描述: 从文档中提取描述事实的源文本,例如: About $1.75 billion of Enrons $3.5 billion in syndicated bank loans come due in May 2002 and will likely need to be restructured.

数据字段

  • description: Enrons $1.75 billion syndicated bank loans due in May 2002 likely need restructuring
  • topic: Enrons Syndicated Bank Loan Restructuring
  • subject: Enron
  • date_of_event: May 2002
搜集汇总
数据集介绍
Wexler/llawma-fact-enrich 数据集图片
背景与挑战
背景概述
该数据集是一个小规模的法律文本数据集,专门用于事实提取和丰富任务,包含500行英文数据,结构化字段包括事实描述、主题、主体和事件日期。它从公共调查文档中提取,旨在支持模型训练,以自动从文本中提炼关键事实信息,适用于特征提取和自然语言处理应用。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务