登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Top 20 keywords that tend to be underestimated by frequency.
Top 20 keywords that tend to be underestimated by frequency.
收藏
Figshare
2019-01-30 更新
2026-04-29 收录
关键词提取
文本特征分析
数据链接:
https://figshare.com/articles/dataset/Top_20_keywords_that_tend_to_be_underestimated_by_frequency_/7650743
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Top 20 keywords that tend to be underestimated by frequency.
应用场景:
创建时间:
2019-01-30
相关数据集
ake-datasets
自然语言处理
关键词提取
这是一个包含大量精选基准数据集的仓库,用于评估自动关键词提取算法。数据集经过Stanford CoreNLP套件预处理,并以XML格式提供。数据集结构包括测试、训练、验证文档和参考关键词,适用于多种语言和文档类型。
github
2024-05-06 更新
66
0
Keyword Extractor API
关键词提取
文本分析
Extract important keywords or key phrases from textual content. With this API, you can easily integrate keyword extraction capabilities into your applications, platforms, or services, enabling you to
RapidAPI
2024-02-10 更新
16
0
评估大语言模型在HTML文件中关键词提取能力的测试数据集
自然语言处理
关键词提取
1、数据采集:提取指定行业相关的公开网页信息,存为HTML文件; 2、数据处理:1)清除HTML文件中的代码信息(如“css、JavaScript代码”)后,保留文字内容;2)从文字内容中提取与业务相关的关键信息(如主题、发布时间、地址、期限、审查结果等);3)对关键信息进行表达方式分类,表达方式分类包括:文本、表格;4)根据不同的表达方式分类定义JSON包,构成在HTML文件中关键词提取能力的测
贵州省数据知识产权登记平台
2025-07-09 更新
14
0
midas/citeulike180
自然语言处理
关键词提取
该数据集用于评估从长文档英文科学文章中提取和生成关键词的技术。数据集包含文档的唯一标识符、文档内容、文档的BIO标签、提取的关键词和生成的关键词。数据分割部分仅包含测试集,共有182个数据点。
Hugging Face
2022-01-23 更新
43
0
Keywords found in each abstract
关键词提取
文本信息抽取
Supplementary Data 2
DataCite Commons
2024-09-25 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广