Bulk PDF OCR
收藏官方服务:
资源简介:
Handles 300-page PDFs in a single request — auto-split and processed in parallel. 106 languages, batch upload, async mode, bounding boxes.
创建时间:
2026-08-05
原始信息汇总
Bulk PDF OCR 数据集详情总结
API 概述
Bulk PDF OCR 是一个基于 PaddleOCR PP-OCRv5 构建的 OCR(光学字符识别)API,运行在分布式 Kubernetes 集群上,支持自动 PDF 分割与并行处理。该 API 能够处理单次请求中多达 300 页的 PDF 文件,支持 106 种语言、批量上传、异步处理模式以及边界框输出。
核心特性
| 特性 | 说明 |
|---|---|
| 106 种语言支持 | 涵盖中文、日文、韩文、阿拉伯文、西里尔文、天城文、泰文、希腊文及 45+ 拉丁字母语言 |
| 自动 PDF 分割 | 大型 PDF 自动分割成块,在多个服务器上并行处理,无需额外配置 |
| 多语言文档 | 单文档最多运行 4 个语言模型,结果通过边界框重叠区域合并 |
| 三种输出格式 | 纯文本、按页分行、完整详情(含置信度和边界框) |
| 批量上传 | 支持单次请求上传多个文件 |
| 异步模式 | 提交任务后轮询获取结果,适合超大型文档 |
| 结果缓存 | 相同文件 1 小时内即时返回(TTL:1 小时) |
| 边界框输出 | 返回每个识别文本行的像素坐标 |
支持的输入文件
PNG、JPEG、WebP、TIFF、BMP、PDF,最大 50 MB。
接口端点
| 端点 | 方法 | 功能说明 |
|---|---|---|
/v1/ocr |
POST | 单文件识别,发送图像或 PDF 并返回文本 |
/v1/ocr/batch |
POST | 批量识别多个文件,每个文件单独返回结果 |
/v1/ocr/async |
POST | 异步提交任务,立即返回 job_id |
/v1/ocr/result/{job_id} |
GET | 查询任务状态(queued、processing、completed、failed) |
/v1/ocr/result/{job_id}/poll |
GET | 长轮询等待任务完成(超时 1–60 秒) |
/v1/languages |
GET | 返回所有支持的语言代码及覆盖范围 |
/v1/stats |
GET | 加载的 OCR 引擎及缓存统计信息 |
/health |
GET | 健康检查,无需参数 |
主要参数
lang(query):语言代码,默认en,最多支持 4 个逗号分隔的代码(如ch,de)output(query):输出格式,可选text、lines、full,默认fullfile或files(form-data):上传的图像或 PDF 文件(必填)
语言代码说明
每个代码加载一个覆盖多种语言的模型:
| 代码 | 覆盖语言 |
|---|---|
en |
英语(优化,速度最快) |
ch |
中文、英语、日语、繁体中文、拼音 |
ru |
俄语、乌克兰语、白俄罗斯语、英语 |
korean |
韩语、英语 |
ar |
阿拉伯语、波斯语、维吾尔语、乌尔都语、普什图语、库尔德语、英语 |
hi |
印地语、马拉地语、尼泊尔语、梵语、英语 |
el |
希腊语、英语 |
th |
泰语、英语 |
ta |
泰米尔语、英语 |
te |
泰卢固语、英语 |
de/fr/es 等 |
45+ 拉丁字母语言(共享同一模型) |
输出格式说明
output=text:纯文本,页面间以空行分隔output=lines:按页分组文本行output=full:每行文本附带置信度分数和边界框多边形坐标(像素坐标,PDF 按 150 DPI 渲染)
PDF 处理机制
| PDF 页数 | 处理方式 |
|---|---|
| 1–5 页 | 单 worker 处理 |
| 6+ 页 | 按 5 页分割成块,分发给多个 worker 并行处理,按原始顺序合并结果 |
300 页 PDF 会被拆分为 60 个块并发处理,约 5 分钟即可完成(单个 worker 约需 25 分钟)。超过约 100 页的文档建议使用 /v1/ocr/async,因为 RapidAPI 网关将在 180 秒后终止连接。
缓存机制
结果缓存 1 小时,以文件 SHA-256 哈希 + lang + output 参数为缓存键。相同文件相同参数重复提交会即时返回("cached": true,"processing_time_sec": 0.0)。缓存命中仍会计入套餐配额。
错误码参考
| 状态码 | 含义 | 处理建议 |
|---|---|---|
400 |
请求中无文件或超过 4 种语言 | 检查表单字段名为 file(批量用 files) |
401 |
API 密钥缺失或无效 | 验证 X-RapidAPI-Key 请求头 |
413 |
文件超过 50 MB | 压缩或拆分文件 |
415 |
不支持的文件类型 | 使用 PNG、JPEG、WebP、TIFF、BMP 或 PDF |
429 |
速率或配额超限 | 等待或升级套餐 |
500 |
处理错误 | 重试;文件可能损坏或受密码保护 |
503 |
异步模式暂时不可用 | 改用 /v1/ocr 同步接口 |
服务限制
| 限制项 | 值 |
|---|---|
| 最大文件大小 | 50 MB |
| 每次请求最大语言数 | 4 |
| PDF 自动分割阈值 | 5 页 |
| 网关同步超时 | 180 秒 |
| 缓存 TTL | 1 小时 |
| 长轮询超时 | 1–60 秒 |
订阅套餐
- BASIC:$0.00 / 月
- PRO:$12.00 / 月
- ULTRA:$49.00 / 月
- MEGA:$199.00 / 月
(每分钟请求数、每月请求数及最大批量大小取决于所选订阅套餐)



