登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Sample Bangla-MedER Entries (English Translation).
Sample Bangla-MedER Entries (English Translation).
收藏
Figshare
2026-02-26 更新
2026-04-28 收录
实体识别
孟加拉语自然语言处理
数据链接:
https://figshare.com/articles/dataset/_p_Sample_Bangla-MedER_Entries_English_Translation_p_/31426595
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Sample Bangla-MedER Entries (English Translation).
应用场景:
创建时间:
2026-02-26
相关数据集
NEMO-Corpus
实体识别
希伯来语
NEMO-Corpus是一个包含希伯来语语料库的命名实体标注数据集,包括词素和词级别的NER标签、嵌套提及等。数据集支持多种标注格式和实体类别,适用于研究形态丰富的语言中的NER任务。
github
2021-12-27 更新
33
0
cvlt-mao/bc5cdr
生物医学
实体识别
该数据集包含文本序列(tokens)及其对应的标签序列(tags),标签用于标注化学物质(Chemical)和疾病(Disease)。数据集分为训练集、验证集和测试集,分别包含5228、5330和5865个示例。
Hugging Face
2024-01-11 更新
24
0
ISSAI KazNERD
实体识别
哈萨克语
Kazakh named entity recognition dataset (KazNERD) contains 112,702 sentences from the television news domain and 136,333 annotations for 25 entity classes. All named entities were labelled using the I
DataCite Commons
2021-11-27 更新
9
0
KyrgyzNER
吉尔吉斯语
实体识别
KyrgyzNER数据集是第一个为吉尔吉斯语手动标注的命名实体识别数据集,包含从24.KG新闻门户网站收集的1,499篇新闻文章。数据集包含10,900个句子和39,075个实体提及,涵盖27个命名实体类别。该数据集旨在解决吉尔吉斯语等低资源语言在自然语言处理任务中的资源匮乏问题,为未来研究提供基准。
arXiv
2025-09-23 更新
26
0
ehealth_kd
实体识别
自然语言处理
该数据集是一个用于命名实体识别(NER)任务的结构化数据集,包含三个主要字段:'text'(原始文本)、'tokens'(分词序列)和'ner_tags'(命名实体标签序列)。命名实体标签共分为8类,包括动作(Action)、概念(Concept)、谓词(Predicate)、引用(Reference)及其相应的起始(B-)和中间(I-)标签,以及普通标签(O)。数据集分为训练集(800个样本)、
Hugging Face
2026-02-07 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广