官方服务:
资源简介:
Source: Psalms (Vietnamese)
来源:越南语版《诗篇》
应用场景:
相关数据集
Skywork/ChineseDomainModelingEval
Skywork/ChineseDomainModelingEval是中文领域建模能力评测数据集,我们对多个领域筛选出2023年9月份-2023年10月份新发布的几百到上千篇高质量文章,并人工进行了核对。测试数据的来源也足够广泛,质量也高。我们可以选取当前最新的文章评测不同模型的Perplexity,模型很难作弊。并且我们会持续按照最新数据评测各个模型效果,动态更新各个模型能力。
Hugging Face2023-11-02 更新500
duwuonline/UIT-VSMEC
该数据集来自UIT(信息技术大学),包含7个类别:其他、厌恶、享受、愤怒、惊讶、悲伤、恐惧。数据集的语言为越南语,主要用于情感分类任务。
Hugging Face2023-08-28 更新160
premio-ai/TheArabicPile_Translations
--- license: cc-by-nc-4.0 dataset_info: - config_name: original features: - name: text dtype: string splits: - name: train num_bytes: 132546483512 num_examples: 289854122 downloa
Hugging Face2024-03-24 更新60
PL-Mix
PL-Mix 是一个平衡的波兰语数据集,专为训练和评估提示级别有害性分类器而设计。该数据集包含 1,040 个提示,均等地分为有害(520)和无害(520)样本,并采用 80/20 分层训练-测试分割。PL-Mix 旨在解决波兰语有害提示检测领域公开可用、平衡且语言多样资源的缺乏问题,支持波兰语言模型的安全性分类和机械可解释性方法研究。 数据集结构方面,每个样本包含以下字段:`text`(波兰语
Hugging Face2026-02-03 更新220
MERA-evaluation/ruVQA
ruVQA是一个用于俄语的公开视觉问答(VQA)数据集,包含真实照片和抽象插图两种类型的图像。问题分为简单和复杂两类,涵盖了多种类型如二元、比较、数量、地点、方式、哪个、什么、谁等。简单问题仅需基于图像的感知,而复杂问题则需要推理步骤。数据集中的图像均来自公开资源,包括真实照片和卡通抽象图像。数据集旨在测试模型在不同类型图像中区分对象、理解不同问题类型并基于图像生成简短答案的能力。
Hugging Face2024-12-11 更新80



