登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Enriched BioLeaflets
Enriched BioLeaflets
收藏
IEEE
2026-04-17 收录
生物医学文本语义增强
信息提取
数据链接:
https://ieee-dataport.org/documents/enriched-bioleaflets
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
A semantically enhanced BioLeaflets dataset.
应用场景:
提供机构:
Yupian Lin
相关数据集
waterlandpe/tag-dataset
文本分类
信息提取
该数据集包含两个主要字段:input_text和extracted_tags,均为字符串类型。数据集仅包含一个训练集(train),共有1532个样本,总大小为7083221字节。数据集的下载大小为4303131字节。
Hugging Face
2024-07-11 更新
100
0
SemTabNet
信息提取
自然语言处理
SemTabNet是一个用于特征提取、表格问答和文本到文本生成任务的数据集,大小在10万到100万之间,主要语言为英语。该数据集与一篇关于使用大型语言模型从表格中提取ESG KPIs的论文相关,提出了一种新的知识模型STATEMENTS,用于从表格或文本中提取量化信息。数据集支持三种任务,每个任务的数据被分为训练、验证和测试集,且所有文本内容均为英语。
Hugging Face
2024-06-27 更新
17
0
MobIE
自然语言处理
信息提取
MobIE 是一个德语数据集,它使用 20 种粗粒度和细粒度实体类型以及地理可链接实体的实体链接信息进行人工注释。该数据集由 3,232 个社交媒体文本和带有 91K 标记的交通报告组成,并包含 20.5K 注释实体,其中 13.1K 链接到知识库。数据集的一个子集使用七种与移动相关的 n 元关系类型进行人工注释,而其余文档使用 Snorkel 框架实现的弱监督标签方法进行注释。该数据集可用于 N
OpenDataLab
2026-07-12 更新
12
0
Effyis/Table-Extraction
自然语言处理
信息提取
该数据集旨在评估大型语言模型(LLMs)从文本中提取表格的能力。它提供了一系列包含表格的文本片段及其对应的JSON格式的结构化表示。数据集基于Table Fact Dataset(也称为TabFact),该数据集包含从维基百科提取的16,573个表格。每个数据点由两部分组成:包含嵌入表格的文本片段(context)和表示提取的表格结构的JSON对象(answer)。JSON对象的格式详细说明了每个
Hugging Face
2024-05-31 更新
21
0
社保卡识别
社保卡识别
信息提取
社保卡识别可识别全国各地社保卡,返回社会保障卡号、姓名、性别、出生日期、银行卡号、有效期限等信息。
华为云市场
2026-04-03 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广