遇见数据集

Urdu Paraphrase Plagiarism Corpus (UPPC)

收藏
DataCite Commons2025-09-23 更新2025-04-17 收录
官方服务:

资源简介:

This corpus contains 160 Urdu text documents in total. 20 documents are original Wikipedia articles on well-known people whereas 140 documents (manually created by volunteers) are paraphrase plagiarise and non-plagiarise versions of the original articles. 75 documents are paraphrased by 5 university students using different paraphrasing techniques. 65 documents are independently written without considering the source article.

提供机构:
Lancaster University
创建时间:
2016-02-29
二维码
社区交流群
二维码
科研交流群
商业服务