登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
luminolous/final-dataset-wiki-indo
luminolous/final-dataset-wiki-indo
收藏
Hugging Face
2025-10-09 更新
2025-10-25 收录
印度尼西亚语
文本数据
数据链接:
https://hf-mirror.com/datasets/luminolous/final-dataset-wiki-indo
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit language: - id ---
应用场景:
提供机构:
luminolous
相关数据集
IMSDb Movie Scripts
电影剧本
文本数据
1282 Movie Scripts scraped from IMSDb
kaggle
2024-12-04 更新
50
0
FalconX80/bhoomillama-5.5k
文本数据
该数据集包含5500个样本,每个样本包含Prompt、Answer和text三个字段,数据类型均为字符串。数据集分为一个训练集,大小为2206576字节。
Hugging Face
2024-07-08 更新
18
0
Charlie-Bell/reddit_comment_reply
社交媒体广告
文本数据
--- license: mit ---
Hugging Face
2023-07-25 更新
11
0
catallama/Catalan-Raw-Text
自然语言处理
文本数据
加泰罗尼亚语原始文本数据集是projecte-aina/catalan_general_crawling数据集的一个子集。该数据集包含404k个样本,总计331M个token,使用Llama-3 Tokenizer进行分词。数据集的语言为加泰罗尼亚语(ca-ES),包含两个数据分割:train和test。数据字段为text(字符串类型)。数据集遵循Creative Commons Attribut
Hugging Face
2024-05-25 更新
22
0
yirenc/10K_general_10K_ethics_2024
文本数据
伦理
--- dataset_info: features: - name: text dtype: string splits: - name: train num_bytes: 22583262.0 num_examples: 19846 download_size: 10899937 dataset_size: 22583262.0 configs:
Hugging Face
2024-05-28 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广