官方服务:
资源简介:
Source: 2 Corinthians (Xhosa)
应用场景:
相关数据集
patrikgerard/combined_uk_ru_dataset_v3
该数据集包含多个特征,包括唯一标识符(unique_id)、输入(input)、分类(classification)和原始数据集(original_dataset)。数据集分为训练集和测试集,训练集包含16417个样本,测试集包含1824个样本。数据集的总下载大小为8831638字节,总数据集大小为18666794字节。
Hugging Face2024-07-12 更新150
Nayana-cognitivelab/Nayana-DocOCR-global-100k
该数据集包含图像、图像ID、翻译后的图像、使用的字体以及区域信息等特征。区域信息包括区域ID、布局类型、边界框、英文文本和翻译后的文本。数据集分为多个语言版本,包括阿拉伯语、法语、德语、西班牙语、意大利语、俄语、泰语和韩语,每个语言版本包含12500个样本。数据集的下载大小为99817505823字节,总大小为107471598026字节。
Hugging Face2024-12-11 更新110
Papers of Ernst Leumann (15): [Upāsakadaśā] Auszüge aus Anga 7 (Upāsakadaśā) ...
[Upāsakadaśā] Auszüge aus Anga 7 (Upāsakadaśā) : ferner aus 1. Samayasāra. 2. Puṣpamālāprakaraṇa. u. aus d. Bhāṣā-Texten: 1. Ṛṣabhavīvāha, 2.3. Niśalyâṣṭamīvṛta-,...
B2FIND70
bot-yaya/UPRPRC_BLOCKWISE
该数据集是一个多语言文本数据集,包含阿拉伯语、中文、德语、英语、世界语、西班牙语、法语、希伯来语、印尼语、意大利语、日语、韩语、荷兰语、葡萄牙语、俄语、瑞典语、泰语、越南语和中文(MD5加密版本)等语言的文本。此外,数据集还包含了段落数、低质量段落数、去重段落数、文件名、时间戳、是否待查文件、是否跨文件重复、是否重复、是否重复文件等元数据信息。数据集分为训练集,其大小为61374874324字节,
Hugging Face2025-11-04 更新150
Sermon_audio_and_text_dataset (SAT)
Sermon_audio_and_text_dataset (SAT) The Sermon Audio and Text (SAT) dataset addresses a significant gap in the realm of Islamic Friday Sermons (IFS) research. It offers a rich collection tailored for
DataCite Commons2025-04-01 更新110



