登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
you_should_know_what_language_you_are_reading
you_should_know_what_language_you_are_reading
收藏
kaggle
2026-02-19 更新
2026-03-21 收录
语言识别
数据链接:
https://www.kaggle.com/datasets/aprajitahanda/you-what-language-you-are-reading
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
You can't learn all of the languages but your model can!!
你无法精通所有语言,但你的模型却可以做到!!
应用场景:
创建时间:
2026-02-19
相关数据集
task533_europarl_es-en_language_identification
语言识别
自然语言处理
该数据集名为'task533_europarl_es-en_language_identification',主要用于文本生成任务,特别是语言识别。数据集包含训练、验证和测试三个分割,分别有5162、645和646个样本。数据集的创建是通过众包完成的,语言为英语。
Hugging Face
2025-01-04 更新
15
0
Wili 2018
语言识别
维基百科
Wikipedia Language Identification
kaggle
2020-08-21 更新
11
0
hcoxec/german_spanish_mix
语言识别
机器翻译
该数据集包含100,000个训练样本,每个样本包含两个特征:sentence(句子)和language(语言),数据类型均为字符串。数据集的总大小为18,270,752字节,下载大小为9,828,884字节。数据文件路径为data/train-*。
Hugging Face
2024-06-07 更新
9
0
hcoxec/german_finnish
语言识别
机器学习
--- dataset_info: features: - name: sentence dtype: string - name: language dtype: string splits: - name: train num_bytes: 18066593 num_examples: 100000 download_size: 9829
Hugging Face
2024-06-07 更新
12
0
Labeled Dataset Of Offensive Language In Arabic
语言识别
网络安全
Dataset Construction for the Detection of Anti-Social Behaviour in Online Commun
kaggle
2023-08-29 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广