遇见数据集

TabFact

收藏
魔搭社区2025-12-03 更新2024-08-31 收录
官方服务:

资源简介:

displayName: TabFact labelTypes: [] license: - CC BY 4.0 mediaTypes: - Text paperUrl: https://arxiv.org/pdf/1909.02164v5.pdf publishDate: "2020" publishUrl: https://tabfact.github.io/ publisher: - University of California - Tencent AI Lab tags: - Comment Statement_x000D_ taskTypes: - Table-based Fact Verification --- # 数据集介绍 ## 简介 TabFact 是一个大规模数据集,由 117,854 条人工注释的语句组成,涉及 16,573 个 Wikipedia 表,它们的关系分为 ENTAILED 和 REFUTED。 TabFact 是第一个评估结构化数据语言推理的数据集,其中涉及符号和语言方面的混合推理技能。 ## 引文 ``` @article{chen2019tabfact, title={Tabfact: A large-scale dataset for table-based fact verification}, author={Chen, Wenhu and Wang, Hongmin and Chen, Jianshu and Zhang, Yunkai and Wang, Hong and Li, Shiyang and Zhou, Xiyou and Wang, William Yang}, journal={arXiv preprint arXiv:1909.02164}, year={2019} } ``` ## Download dataset :modelscope-code[]{type="git"}

displayName: TabFact labelTypes: [] license: - CC BY 4.0 mediaTypes: - 文本 paperUrl: https://arxiv.org/pdf/1909.02164v5.pdf publishDate: "2020" publishUrl: https://tabfact.github.io/ publisher: - 加利福尼亚大学(University of California) - 腾讯人工智能实验室(Tencent AI Lab) tags: - 评述语句(Comment Statement) taskTypes: - 基于表格的事实验证(Table-based Fact Verification) --- # 数据集介绍 ## 简介 TabFact 是一款大规模数据集,涵盖117,854条人工标注语句,关联16,573个维基百科(Wikipedia)表格,语句与表格的语义关系分为ENTAILED(蕴含)与REFUTED(驳斥)两类。TabFact 是首个用于评估结构化数据语言推理能力的数据集,其任务涉及符号推理与语言推理的混合技能。 ## 引文 @article{chen2019tabfact, title={Tabfact: A large-scale dataset for table-based fact verification}, author={Chen, Wenhu and Wang, Hongmin and Chen, Jianshu and Zhang, Yunkai and Wang, Hong and Li, Shiyang and Zhou, Xiyou and Wang, William Yang}, journal={arXiv preprint arXiv:1909.02164}, year={2019} } ## 下载数据集 :modelscope-code[]{type="git"}

提供机构:
maas
创建时间:
2024-07-10
搜集汇总
数据集介绍
TabFact 数据集图片
背景与挑战
背景概述
TabFact是一个大规模数据集,包含117,854条基于16,573个维基百科表格的人工标注陈述,其关系被分类为ENTAILED和REFUTED。该数据集是首个用于评估结构化数据语言推理的资源,融合了符号与语言推理能力。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务