登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Analysis results of high-frequency subject words in the LDA model.
Analysis results of high-frequency subject words in the LDA model.
收藏
Figshare
2022-09-13 更新
2026-04-28 收录
主题建模
文献数据挖掘
数据链接:
https://figshare.com/articles/dataset/Analysis_results_of_high-frequency_subject_words_in_the_LDA_model_/21094088
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Analysis results of high-frequency subject words in the LDA model.
应用场景:
创建时间:
2022-09-13
相关数据集
s1k_small
文献数据挖掘
机器学习
该数据集包含了问题和解决方案的文本对,以及其他相关信息,如解决类型、来源类型、元数据等。数据集分为训练集,共有500个示例。数据集还包含了思考轨迹和尝试的信息,这些信息可能是序列化的字符串。
Hugging Face
2025-02-13 更新
47
0
Results from topic modeling of Song Exploder transcripts
文本分析
主题建模
Comparison of the output using different parameters in Mallet to generate applicable topic models for Song Exploder and the parameters of the final version.
DataCite Commons
2025-07-30 更新
15
0
AISE-TUDelft/MIA-near-public
文献数据挖掘
软件开发
该数据集包含了从GitHub仓库中提取的文件信息,包括文件的id、名称、路径、内容、大小、语言、扩展名、行数、平均行长度、最大行长度、字母数字比例等。同时,还包括了仓库的相关信息,如仓库名称、star数、fork数、open issue数、许可证类型和提取日期。另外,数据集还标识了文件在Redpajama、GitHubcode和StackExchange数据集中的重复情况。数据集分为训练集和测试集
Hugging Face
2025-11-04 更新
8
0
CSPubSum
自然语言处理
文献数据挖掘
该数据集包含了从ScienceDirect上选取的10147篇计算机科学出版物的URL,内容涵盖了标题、摘要、作者撰写的研究亮点等多个部分。数据集被划分为训练集、验证集和测试集,分别包含8116、1017和1014个样本。为了提升研究亮点的自动生成效果,实验中采用了多种输入配置。该数据集的规模为10147篇出版物,任务目标是自动生成研究亮点。
arXiv
16
0
polygraf-ai/mirror_prompts_combined_v1
在线评论
文献数据挖掘
该数据集是一个包含多种类型特征的数据集,包括文本内容、评分、文本块、日期、用户信息、商家信息等,适用于多种文本分析和处理任务。数据集分为训练集,包含了大量的示例,适用于机器学习模型的训练。
Hugging Face
2025-04-02 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广