官方服务:
资源简介:
A Reflective View on Text Similarity
关于文本相似度的反思性视角
应用场景:
相关数据集
tabilab/biosses
BIOSSES是一个用于生物医学句子相似性估计的基准数据集。该数据集包含100个句子对,每个句子对选自TAC(文本分析会议)生物医学摘要跟踪训练数据集中的生物医学领域文章。句子对由五位不同的人类专家评估其相似性,并给出0(无关系)到4(等价)的评分。在原始论文中,五位人类注释者评分的平均值被作为黄金标准。使用Pearson相关系数作为评估指标,评估模型估计的评分与黄金标准评分之间的相关性。
Hugging Face2024-01-10 更新1510
marcov/stsb_multi_mt_en_promptsource
该数据集包含两个句子(sentence1和sentence2)、它们的相似度评分(similarity_score)、模板名称(template_name)、模板(template)、渲染输入(rendered_input)和渲染输出(rendered_output)。数据集分为训练集(train)、测试集(test)和开发集(dev)三个部分,分别包含28745、6895和7500个示例。数据集
Hugging Face2024-11-25 更新100
liuyanchen1015/MULTI_VALUE_mrpc_serial_verb_give
--- dataset_info: features: - name: sentence1 dtype: string - name: sentence2 dtype: string - name: label dtype: int64 - name: idx dtype: int64 - name: value_score dtyp
Hugging Face2023-04-03 更新90
Additional file 2 of simona: a comprehensive R package for semantic similarity analysis on bio-ontologies
Supplementary Material 2. The algorithm
DataCite Commons2024-09-17 更新100
Additional file 16 of Advancing AI-driven thematic analysis in qualitative research: a comparative study of nine generative models on Cutaneous Leishmaniasis data
Supplementary Material 16: Additional file 9bis. Jaccard index raw database
Figshare2025-03-11 更新90



