登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
NLPC-UOM/Sinhala-Stopword-list
NLPC-UOM/Sinhala-Stopword-list
收藏
Hugging Face
2022-10-25 更新
2024-03-04 收录
自然语言处理
停用词
数据链接:
https://hf-mirror.com/datasets/NLPC-UOM/Sinhala-Stopword-list
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- annotations_creators: [] language: - si license: - mit ---
应用场景:
提供机构:
NLPC-UOM
原始信息汇总
数据集概述
语言
斯里兰卡语(si)
许可证
MIT许可证
相关数据集
MicPie/unpredictable_cluster15
自然语言处理
机器学习
UnpredicTable数据集由从互联网表格中提取的少样本任务组成,旨在通过微调语言模型来提高其在少样本学习中的表现。数据集包含多个版本和子集,涵盖了广泛的任务类型,如多项选择、问答、文本分类等。数据集的创建基于WDC Web Table Corpus,并通过自动化的方式将表格转换为少样本学习任务。
Hugging Face
2022-08-04 更新
19
0
charan101/input_target_pairs_50_final
机器学习
自然语言处理
该数据集包含两个主要特征:input和target,均为字符串类型。数据集包含一个训练分割,大小为134742字节,包含353个示例。数据集的下载大小为73111字节,总大小为134742字节。默认配置文件指定了数据文件的路径为data/train-*。
Hugging Face
2024-06-20 更新
9
0
srbdtwentyfour/three_parts_cleaned
自然语言处理
对话系统
--- dataset_info: features: - name: id dtype: int64 - name: prompt dtype: string - name: response dtype: string - name: model dtype: string splits: - name: train num_
Hugging Face
2024-06-09 更新
6
0
oda-99/aozora_head_3_consonant_romaji
自然语言处理
罗马音标注音
该数据集包含了文本的部分(section)、押韵(rhyme)和新的文本(new_text)三个字段。数据集被分割为训练集和测试集,其中训练集包含1009225个示例,测试集包含112137个示例。
Hugging Face
2025-01-05 更新
10
0
rookshanks/toy_dataset_correcting
自然语言处理
问答系统
--- dataset_info: features: - name: question sequence: int64 - name: answer_prefix sequence: int64 - name: answer_continuation sequence: int64 splits: - name: train num_byt
Hugging Face
2023-08-16 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广