登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
1-800-SHARED-TASKS/BPCC_Telugu
1-800-SHARED-TASKS/BPCC_Telugu
收藏
Hugging Face
2024-09-26 更新
2024-12-14 收录
数据链接:
https://hf-mirror.com/datasets/1-800-SHARED-TASKS/BPCC_Telugu
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
许可证:Apache-2.0
应用场景:
提供机构:
1-800-SHARED-TASKS
相关数据集
1-800-SHARED-TASKS/civil_comments_Safety
文本分类
毒性识别
该数据集名为Civil Comments,主要包含来自Civil Comments平台的评论数据,这些评论是从2015年到2017年间在全球约50个英语新闻网站上发布的。数据集由Jigsaw扩展,增加了毒性和身份提及的标签。数据集的结构包括文本、毒性、严重毒性、淫秽、威胁、侮辱、身份攻击和性明确等字段。数据集分为训练集、验证集和测试集,分别包含1804874、97320和97320个样本。数据集的
Hugging Face
2024-09-26 更新
22
0
1-800-SHARED-TASKS/allenai-multipref
大语言模型偏好对齐
多维度模型评估
--- language: - en tags: - preference - rlhf - dpo pretty_name: MultiPref size_categories: - 1K<n<10K --- # MultiPref - a multi-annotated and multi-aspect human preference dataset [Paper: coming soo
Hugging Face
2024-09-26 更新
10
0
1-800-SHARED-TASKS/transliteration-telugu-phrases
自然语言处理
转写
该数据集包含四个主要特征:唯一标识符、本地词、英文词和来源。数据被分为训练集、测试集和验证集,分别包含不同数量的字节和示例。训练集包含2429562个示例,测试集包含10260个示例,验证集包含7681个示例。数据集的总下载大小为91663334字节,总数据集大小为191291625字节。
Hugging Face
2024-09-26 更新
8
0
1-800-SHARED-TASKS/COLING-2025-GENAI-3
AI生成内容检测
对抗性攻击
RAID是用于评估AI生成文本检测器的最大且最全面的数据集。它包含超过1000万份文档,涵盖11种大型语言模型、11种文体、4种解码策略和12种对抗攻击。该数据集旨在成为开源和闭源生成文本检测器的可信第三方评估的首选资源。
Hugging Face
2024-10-02 更新
11
0
1-800-SHARED-TASKS/LID201_Devanagari_Script_Languages_Identification
天城文OCR
多语言文本分类
该数据集包含文本(text)和标签(label)两种类型的字段,均为字符串格式。它分为训练集(train),共有约303万条样本,数据大小为1002760559字节。尽管README没有提供详细的数据集描述,但从文件结构和大小来看,这可能是一个用于文本分类或标签预测的大型数据集。
Hugging Face
2024-09-19 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广