遇见数据集

中文文本语义相似度

收藏
魔搭社区2026-07-15 更新2024-05-15 收录
官方服务:

资源简介:

文本语义相似度(Semantic Text Similarity)是自然语言处理处理中的基本问题,目前英文sts语料训练数据较为丰富,中文sts(Chinese Semantic Text Similarity)语料很少,而语料是文本进行深度学习的基本起点。

Semantic Text Similarity (STS) is a fundamental problem in natural language processing (NLP). Currently, English STS training corpora are relatively abundant, while Chinese STS (Chinese Semantic Text Similarity) corpora are scarce. Furthermore, corpora serve as the fundamental starting point for deep learning on text data.

提供机构:
maas
创建时间:
2022-09-28
搜集汇总
数据集介绍
中文文本语义相似度 数据集图片
背景与挑战
背景概述
该数据集是一个中文文本语义相似度语料库,相似度评分范围为0到5分,用于支持问答、搜索等自然语言处理任务。它旨在弥补中文语义相似度训练数据相对不足的问题,为深度学习提供基础资源。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务