TACRED
收藏资源简介:
TACRED是一个大规模的关系提取数据集,在每年的TAC知识库人口 (TAC KBP) 挑战中使用的语料库中,通过newswire和web文本构建了106,264个示例。TAC KBP挑战中使用的TACRED中的示例涵盖41种关系类型 (例如,per: schools_attled和org: memers),或者如果未保留定义的关系,则标记为no_relation。这些示例是通过结合TAC KBP挑战和众包中的可用人工注释创建的。
TACRED is a large-scale relation extraction dataset consisting of 106,264 examples constructed from newswire and web text corpora used in the annual TAC Knowledge Base Population (TAC KBP) Challenges. Examples from TACRED utilized for the TAC KBP Challenges encompass 41 distinct relation types (e.g., per: schools_attended and org: members), and are labeled as no_relation if no valid predefined relation is applicable. These examples were created by combining available manual annotations from the TAC KBP Challenges and crowdsourcing workflows.

- TACRED数据集首次发表,由斯坦福大学自然语言处理小组发布,旨在推动关系抽取任务的研究。
- TACRED数据集在多个自然语言处理会议上被广泛讨论,成为关系抽取领域的重要基准数据集。
- 基于TACRED数据集的研究论文数量显著增加,多个研究团队提出了新的模型和方法,提升了关系抽取的性能。
- TACRED数据集被应用于多个实际项目中,包括信息抽取、问答系统和知识图谱构建等领域。
- TACRED数据集的扩展版本发布,增加了更多的实体类型和关系类型,进一步丰富了数据集的内容。



