登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
NoTa tagger
NoTa tagger
收藏
B2FIND
2026-04-25 收录
挪威口语处理
词性标注
数据链接:
https://b2find.eudat.eu/dataset/c3c94250-75f1-572d-8b31-92bfdec50e80
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Statistical tagger for Norwegian spoken language
应用场景:
相关数据集
Penn Treebank
自然语言处理
词性标注
英语Penn Treebank (PTB) 语料库,尤其是与《华尔街日报》 (WSJ) 的文章相对应的语料库部分,是用于评估序列标记模型的最著名和最常用的语料库之一。该任务包括用词性标签注释每个单词。在这个语料库的最常见的拆分中,从0到18的部分用于训练 (38个219句子,912个344标记),从19到21的部分用于验证 (5个527句子,131个768标记),和部分从22到24用于测试 (5
OpenDataLab
2026-07-12 更新
597
0
Buckwalter Arabic Morphological Analyzer Version 2.0
阿拉伯语形态分析
词性标注
Introduction This file contains documentation on the Buckwalter Arabic Morphological Analyzer Version 2.0. Data The data consists primarily of three Arabic-E
DataCite Commons
2021-07-01 更新
22
0
Noun Verb Dataset
词性标注
自然语言处理
该数据集包含自然发生的英语句子,这些句子具有非平凡的名词-动词歧义。数据集用于帮助英语词性标注器改进在名词-动词歧义上的表现,从而提高翻译和文本到语音合成的下游任务的准确性。
github
2024-02-26 更新
14
0
SEACrowd/khmer_alt_pos
词性标注
语言处理
该数据集包含20,000个高棉语句子,这些句子经过了手动分词和词性标注(POS-tagging)的注释。数据集的主要用途是支持词性标注任务。数据集的语言为高棉语(khm)。
Hugging Face
2024-06-24 更新
23
0
prakod/GLuecos_POS_EN_HI_FG
词性标注
跨语言分析
--- dataset_info: features: - name: words sequence: string - name: label1 sequence: string - name: label2 sequence: string splits: - name: dev_Romanized num_bytes: 110280
Hugging Face
2024-05-31 更新
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广