遇见数据集

IndicTextFake/IndicTextFake

收藏
Hugging Face2026-05-06 更新2026-05-31 收录
官方服务:

资源简介:

IndicTextFake是一个多语言基准数据集,用于在语义保持扰动下对印度语言进行AI生成文本检测。该基准旨在评估文本深度伪造检测器在低资源多语言环境中的鲁棒性和泛化能力。它包含人类撰写和机器生成的文本,涵盖14种印度语言,涉及两个主要语言家族:印度-雅利安语系和达罗毗荼语系。除了标准的AI文本检测评估外,IndicTextFake还包括基于扰动的鲁棒性协议,使用多语言释义和回译管道。

IndicTextFake is a multilingual benchmark for AI-generated text detection across Indic languages under semantic-preserving perturbations. The benchmark is designed to evaluate the robustness and generalization capabilities of text deepfake detectors in low-resource and multilingual settings.

提供机构:
IndicTextFake
二维码
社区交流群
二维码
科研交流群
商业服务