登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Vietnamese Curated Dataset
Vietnamese Curated Dataset
收藏
kaggle
2025-01-26 更新
2025-02-23 收录
越南语处理
文本数据集
数据链接:
https://www.kaggle.com/datasets/ndy001/vietnamese-curated-dataset-2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Vietnamese Curated Text Dataset
越南语精选文本数据集
应用场景:
创建时间:
2025-01-26
相关数据集
IAM Handwriting dataset
手写识别
文本数据集
IAM手写数据集包含由657位不同作者书写的115,320个孤立且标记的单词图像。
github
2024-03-08 更新
483
0
olmo-mix-1124
自然语言处理
文本数据集
# OLMo 2 (November 2024) Pretraining set Collection of data used to train OLMo-2-1124 models. The majority of this dataset comes from DCLM-Baseline with no additional filtering, but we provide the e
魔搭社区
2026-06-27 更新
24
0
nlp-datasets
自然语言处理
文本数据集
包含自然语言处理(NLP)相关文本数据集的字母顺序列表,主要提供免费/公共领域的文本数据集。
github
2019-03-26 更新
17
0
ViFactCheck
事实核查
越南语处理
ViFactCheck是第一个公开的越南语事实核查基准数据集,专门为越南语事实核查设计,包含7,232个人工标注的声明-证据对,涵盖了12个不同的主题。
github
2025-03-22 更新
25
0
h-8m-cleaned-and-prompts
自然语言处理
文本数据集
该数据集包含三个配置文件,分别为chunk-00000、chunk-00001和chunk-00006。每个配置文件都包含两个特征:清理后的文本(cleaned_text)和提示(prompt),均为字符串类型。数据集仅包含训练集split,每个split的大小略有不同。总下载大小约为1.5GB,总数据集大小约为2.6GB。
Hugging Face
2025-09-04 更新
24
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广