登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Turkish Wikipedia Dataset
Turkish Wikipedia Dataset
收藏
kaggle
2024-03-19 更新
2024-04-26 收录
维基百科
语言数据
数据链接:
https://www.kaggle.com/datasets/osmankagankurnaz/turkish-wikipedia-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Turkish Wikipedia May 2023
2023年5月土耳其语维基百科(Turkish Wikipedia)
应用场景:
创建时间:
2024-03-19
相关数据集
amitness/wikipedia_mt
自然语言处理
维基百科
--- language: mt dataset_info: features: - name: id dtype: string - name: url dtype: string - name: title dtype: string - name: text dtype: string splits: - name: train
Hugging Face
2023-08-14 更新
20
0
homersimpson/opensubtitles_fr
机器翻译
语言数据
该数据集包含电影相关的元数据和翻译信息,具体包括电影的ID、年份、IMDb ID、字幕ID及其对应的语言(加泰罗尼亚语和法语)。数据集分为训练集、验证集和测试集,分别包含240000、30000和30000个示例。数据集的总下载大小为26004408字节,总大小为36369003字节。
Hugging Face
2023-12-05 更新
16
0
Data from: Robust clustering of languages across Wikipedia growth
维基百科
语言集群
Wikipedia is the largest existing knowledge repository that is growing on a genuine crowdsourcing support. While the English Wikipedia is the most extensive and the most researched one with over five
DataONE
2017-09-19 更新
10
0
mmnga/wikipedia-ja-20230720-50k
维基百科
日本语应用
该数据集是从[izumi-lab/wikipedia-ja-20230720]中随机抽取的50,000条记录,包含curid、title和text三个特征。数据集分为train分割,下载大小为78354971字节,数据集大小为134082445.03326812字节。
Hugging Face
2023-09-25 更新
18
0
1rsh/translate-awadhi-hi-karya
语音翻译
语言数据
该数据集包含音频和句子两种特征,分为训练集和测试集。训练集包含2724个示例,占用138027956.75559068字节;测试集包含237个示例,占用12105741.108409321字节。总下载大小为144229744字节,数据集总大小为150133697.864字节。
Hugging Face
2024-02-09 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广