登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
PDF_1306_BOOKS
PDF_1306_BOOKS
收藏
kaggle
2026-06-06 更新
2026-06-17 收录
电子书文档
PDF处理
数据链接:
https://www.kaggle.com/datasets/azmaysameen/pdf-1306-books
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
pdf_ book_dataset with pages 101
包含101页的PDF图书数据集(pdf_ book_dataset)
应用场景:
创建时间:
2026-06-06
相关数据集
PaperPDF
多模态模型
PDF处理
PDF-WuKong数据集是一个用于高效长PDF阅读的大型多模态模型,包含从PDF文档中提取的文本和图像信息。数据集分为训练集和测试集,每个数据实例包括PDF名称、类别、查询、两个答案和证据对象。训练集和测试集的答案格式不同,训练集包含一个简洁答案和一个详细答案,而测试集包含两个简洁答案,分别使用少量关键词和一句话。数据集的创建使用了Gemini 1.5 Flash和GPT-4及GPT-4v。
Hugging Face
2024-10-20 更新
285
0
PDF.co
PDF处理
文档技术
Converts, splits and merges PDF, adds virtual signatures, makes PDF searchable, generates and reads barcodes, fill in forms and more.
RapidAPI
2019-07-30 更新
21
0
uv-scripts/dataset-creation
数据集构建
PDF处理
这是一个可以将本地PDF文件目录转换为Hugging Face数据集的脚本。它支持从文件夹结构自动标记,无需配置即可使用,并能直接上传数据集到Hugging Face Hub。适用于处理大量PDF文件,并可以根据需要进行文本提取、图像转换等操作。
Hugging Face
2025-07-23 更新
14
0
PDF to OCR
PDF处理
OCR
The "PDF to OCR" API is a powerful tool that allows developers to convert regular PDF documents into PDFs with an OCR (Optical Character Recognition) layer. This API combines the functionalities of PD
RapidAPI
2024-03-14 更新
34
0
PDF识别OCR
OCR
PDF处理
PDF识别能力可以对PDF上的文字进行结构化识别。基于创新的算法模型,准确率可达99%以上!
华为云市场
2026-01-05 更新
18
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广