遇见数据集

suraj-ranganath/unified_tell_dataset

收藏
Hugging Face2026-05-07 更新2026-05-31 收录
官方服务:

资源简介:

该存储库包含用于AI生成文本检测的刷新版统一TELL二元来源语料库。数据集整合了多个公开和研究数据集,用于区分人类文本和AI生成文本,标签约定为0表示人类文本,1表示AI生成文本。数据集包含多种语言,主要语言为英语、德语、捷克语和西班牙语,总行数超过900万。

This repository contains the refreshed unified TELL binary-provenance corpus for AI-generated text detection.

提供机构:
suraj-ranganath
二维码
社区交流群
二维码
科研交流群
商业服务