登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Multilingual Student Complaint Dataset
Multilingual Student Complaint Dataset
收藏
kaggle
2026-04-14 更新
2026-06-17 收录
学生投诉分析
多语言文本分类
数据链接:
https://www.kaggle.com/datasets/sheshanksingh/complaint
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
A multilingual English-Hinglish student complaint dataset
多语言英语-印英混合语(Hinglish)学生投诉数据集
应用场景:
创建时间:
2026-04-14
相关数据集
daikin-industries-ltd/ja-fineweb-2-hvac-fastText-filtered-v4
HVAC
多语言文本分类
该数据集是基于llm-jp/llm-jp-corpus-v3的ja_fineweb_2数据,使用fastText分类器提取HVAC(空调、供暖、通风、空气调节)相关文本的过滤数据集。数据集包含749,060条记录,每条记录包含文本、元数据、fastText分类标签和分数。数据集使用CC BY-SA 4.0许可,语言为日语,大小为100K到1M之间。
Hugging Face
2025-12-22 更新
10
0
1-800-SHARED-TASKS/LID201_Devanagari_Script_Languages_Identification
天城文OCR
多语言文本分类
该数据集包含文本(text)和标签(label)两种类型的字段,均为字符串格式。它分为训练集(train),共有约303万条样本,数据大小为1002760559字节。尽管README没有提供详细的数据集描述,但从文件结构和大小来看,这可能是一个用于文本分类或标签预测的大型数据集。
Hugging Face
2024-09-19 更新
9
0
SkyWater21/ru_twitter_emotions
情感分析
多语言文本分类
该数据集是一个用于文本分类任务的多语言数据集,支持英语和俄语。数据集包含俄语文本(ru_text)、英语文本(text)和情感标签(label),情感标签包括悲伤、喜悦、爱、愤怒、恐惧和惊讶六种。数据集分为训练集、验证集和测试集,分别包含333447、41681和41681个样本。数据集的下载大小为68831057字节,总大小为129699912.0字节。
Hugging Face
2024-11-12 更新
8
0
mbzuai-ugrip-statement-tuning/MultiLingualCombination-Full
多语言文本分类
--- dataset_info: features: - name: Text dtype: string - name: label dtype: int64 splits: - name: train num_bytes: 81809107 num_examples: 84000 download_size: 28978178 da
Hugging Face
2024-06-11 更新
9
0
language-identification
语言识别
多语言文本分类
Language Identification dataset 汇集了 9 万个文本段落及其对应语言标签的样本。它支持多语言环境下的文本分类任务,尤其适用于训练语言识别模型。该数据集由来自 Multilingual Amazon Reviews Corpus、XNLI 和 STSb Multi MT 三个来源的数据整合而成,包含 20 种语言的文本。数据集分为训练集(7 万样本)、验证集和测试集(
Opencsg
2024-07-19 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广