Invoice & Receipt Extractor — OCR-Powered Data Extraction
收藏数据链接:
官方服务:
资源简介:
Upload an invoice or receipt (photo, scan, or PDF) and get structured JSON: vendor, date, line items, subtotal, tax, total. Smart text-layer fast path for e-invoices.
创建时间:
2026-08-22
原始信息汇总
Invoice & Receipt Extractor — OCR-Powered Data Extraction(发票与收据提取器)
数据集/API 概述
这是一个基于 OCR(光学字符识别)技术的发票与收据数据提取API,能够将收据和发票转换为适合会计处理的结构化数据。该API定位于视觉识别类别,旨在以远低于企业级文档AI平台的每文档价格提供高效的数据提取服务。
工作原理
- 电子发票快速解析:对于数字生成的PDF电子发票,API会自动检测并直接从其嵌入的文本层解析数据,速度接近即时,无需OCR处理(数据来源标记为
pdf-text-layer) - OCR识别:对于照片、扫描件和纯图像PDF,通过OCR技术处理,支持最多10页的多页PDF(数据来源标记为
ocr) - 启发式解析:从识别结果中提取供应商、日期、货币、行项目、小计、税费和总计等信息
核心特点
- 透明性保障:每次响应都包含
warnings数组(如“未找到总计”)和完整的rawText原始文本,用户始终了解提取器的置信情况,避免静默猜测 - 多语言支持:默认支持英语,另有法语、德语、西班牙语、葡萄牙语、意大利语
- 支持的输入格式:JPG、PNG、WebP、TIFF 图片或 PDF,文件最大10MB
端点信息
- 接口地址:
POST /invoice/extract(multipart/form-data 格式) - 请求参数:
file(必需):支持 jpg / png / webp / tiff / pdf 格式,最大10MBlanguage(可选):支持 eng(默认)、fra、deu、spa、por、ita
响应示例
json { "success": true, "message": "Invoice extracted successfully.", "data": { "vendor": "Joes Coffee Shop", "date": "07/29/2026", "currency": "USD", "lineItems": [ { "description": "Latte", "amount": 4.5 }, { "description": "Croissant", "amount": 3.25 } ], "subtotal": 9.5, "tax": 0.86, "total": 10.36, "warnings": [], "rawText": "Joes Coffee Shop 123 Main St…", "source": "ocr" } }
使用建议
- 光线充足、正对拍摄的照片OCR效果显著优于倾斜或模糊照片
- 电子发票PDF比扫描件速度更快且准确率更高,有条件时优先使用
- 信任字段前务必检查
warnings,对于边缘布局可回退参考rawText
应用场景
适用于费用追踪应用、会计自动化、簿记录入以及金融科技产品中的收据扫描功能。
定价方案
| 方案 | 价格 |
|---|---|
| BASIC | $0.00 / 月 |
| PRO | $9.99 / 月 |
| ULTRA | $99.99 / 月 |
| MEGA | $459.99 / 月 |
提供方信息
- API创建者:ForCom
- 类别:视觉识别(Visual Recognition)
- 订阅者数量:1




