遇见数据集

NLPC-UOM/Tamil-Sinhala-short-sentence-similarity-deep-learning

收藏
Hugging Face2025-03-28 更新2024-03-04 收录
官方服务:

资源简介:

该研究专注于寻找最佳的基于深度学习的技术,用于测量低资源语言(泰米尔语和僧伽罗语)的短句相似性。研究利用了现有的无监督技术,这些技术最初是为英语开发的。

This study focuses on identifying the optimal deep learning-based techniques for measuring short sentence similarity in low-resource languages, namely Tamil and Sinhala. It leverages existing unsupervised techniques that were originally developed for English.

提供机构:
NLPC-UOM
原始信息汇总

数据集概述

语言

  • 泰米尔语 (ta)
  • 僧伽罗语 (si)

许可证

  • MIT 许可证

研究重点

  • 利用现有的无监督技术,针对泰米尔语和僧伽罗语的短句,通过深度学习技术测量句子相似度。
二维码
社区交流群
二维码
科研交流群
商业服务