官方服务:
资源简介:
Entailment is a tool for recognizing semantic relations between sentences.
应用场景:
相关数据集
中文成语语义推理数据集(CINLID)
计算词/词组、句子、段落和文档之间的语义相似性(STS,Semantic similarity of text)在自然语言处理和计算语言学中起着重要作用,是一个非常重要的任务。 语义相似性中的条目(词、短语、句等)之间的距离概念是基于其意义或语义内容的相似性,而不是词汇学的相似性。基于字面含义的“望文生义”在做NLP相关任务时很容易出现问题,如传统测度文本相似度的方法经常会把“目不识丁”和“目中
千言数据集250
openbmb/factnet_factsynset
FactSynset是FactNet的语义等价层,它将相似的FactStatements聚合为具有规范化值的统一语义类。它提供了语义等价事实的跨语言视图,支持跨语言障碍的推理。数据集包含parquet文件,其中包含多个关键字段,如synset_id(语义等价类的唯一标识符)、aggregation_key(聚合键)、member_statement_ids(该synset中的FactStateme
Hugging Face2026-05-07 更新140
mlburnham/scad_event_entailment
该数据集是一个关于事件蕴含(event entailment)的数据集,包含训练集和测试集。每个样本包含前提(premise)、目标(target)、假设(hypothesis)、蕴含关系(entailment)、已验证标签(validated_label)和验证来源(validation_source)等特征。训练集包含2581个样本,测试集包含1077个样本。
Hugging Face2024-07-20 更新50
TERRa (Textual Entailment Recognition for Russian)
文本蕴涵识别最近被提出作为一项通用任务,它可以捕获许多 NLP 应用程序中的主要语义推理需求,例如问答、信息检索、信息提取和文本摘要。该任务需要识别给定两个文本片段,一个文本的含义是否需要(可以推断)来自另一个文本。
OpenDataLab2026-07-12 更新150
Lajavaness/negation-bilingual_dataset
这是一个双语数据集,包含否定三元组。它从否定数据集中翻译而来。每个数据点由三个字符串组成的三元组(anchor、entailment、negative),其中(anchor、entailment)是来自SNLI的正对,而negative则与两者矛盾。数据集包含英语和法语两种语言,训练集包含50000个示例。
Hugging Face2024-07-04 更新90



