登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Mahabharata_sample
Mahabharata_sample
收藏
B2FIND
2026-04-29 收录
梵语文本处理
词形还原
数据链接:
https://b2find.eudat.eu/dataset/438eb2f4-ac4b-51fc-9cb2-1713fec3554f
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
lemmatised Sanskrit text with lemma IDs, white-space delimited
应用场景:
相关数据集
yalhessi/lemexp
自然语言处理
词形还原
该数据集包含两个配置:default和hol。每个配置都包含三个主要特征:defs(定义)、symbols(符号)和lemma(词元)。数据集主要用于训练,包含32920个示例。default配置的总数据大小为75847048字节,而hol配置的总数据大小为73239698字节。这些特征表明数据集可能用于自然语言处理任务,如词义消歧或语义分析。
Hugging Face
2024-07-02 更新
13
0
snskrt/Shrimad_Bhagavad_Gita
梵语文本处理
宗教文本分析
Shrimād Bhāgavad Gitā数据集包含梵文和英文文本,适用于文本分类、标记分类、翻译、摘要、文本生成等多种自然语言处理任务。数据集规模小于1K,适合用于小规模的语言处理研究和开发。
Hugging Face
2025-05-10 更新
8
0
Tarkaśāstra (reconstructed text)
逻辑学研究
梵语文本处理
Source: Tarkaśāstra (reconstructed text)
B2FIND
5
0
chronbmm/sanskrit-unsandhi-lemma-morphosyntax-tagging
梵语文本处理
形态句法分析
--- dataset_info: features: - name: sentence dtype: string - name: unsandhied dtype: string splits: - name: train num_bytes: 124323563 num_examples: 584830 - name: validati
Hugging Face
2024-05-04 更新
9
0
snskrt/Shrimad_Bhagvat_Puran
梵语文本处理
印度教经典分析
Vishnu Puran是一个萨姆斯克里特语数据集,适用于多种NLP任务,包括文本分类、标记分类、问答、翻译、摘要、文本生成和文本到文本生成。数据集大小在10K到100K之间,可能与代码有关。
Hugging Face
2025-05-12 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广