遇见数据集

Invoice & Receipt Extractor — OCR-Powered Data Extraction

收藏
RapidAPI2026-08-22 更新2026-08-11 收录
官方服务:

资源简介:

Upload an invoice or receipt (photo, scan, or PDF) and get structured JSON: vendor, date, line items, subtotal, tax, total. Smart text-layer fast path for e-invoices.

创建时间:
2026-08-22
原始信息汇总

Invoice & Receipt Extractor — OCR-Powered Data Extraction(发票与收据提取器)

数据集/API 概述

这是一个基于 OCR(光学字符识别)技术的发票与收据数据提取API,能够将收据和发票转换为适合会计处理的结构化数据。该API定位于视觉识别类别,旨在以远低于企业级文档AI平台的每文档价格提供高效的数据提取服务。

工作原理

  1. 电子发票快速解析:对于数字生成的PDF电子发票,API会自动检测并直接从其嵌入的文本层解析数据,速度接近即时,无需OCR处理(数据来源标记为 pdf-text-layer
  2. OCR识别:对于照片、扫描件和纯图像PDF,通过OCR技术处理,支持最多10页的多页PDF(数据来源标记为 ocr
  3. 启发式解析:从识别结果中提取供应商、日期、货币、行项目、小计、税费和总计等信息

核心特点

  • 透明性保障:每次响应都包含 warnings 数组(如“未找到总计”)和完整的 rawText 原始文本,用户始终了解提取器的置信情况,避免静默猜测
  • 多语言支持:默认支持英语,另有法语、德语、西班牙语、葡萄牙语、意大利语
  • 支持的输入格式:JPG、PNG、WebP、TIFF 图片或 PDF,文件最大10MB

端点信息

  • 接口地址POST /invoice/extract(multipart/form-data 格式)
  • 请求参数
    • file(必需):支持 jpg / png / webp / tiff / pdf 格式,最大10MB
    • language(可选):支持 eng(默认)、fra、deu、spa、por、ita

响应示例

json { "success": true, "message": "Invoice extracted successfully.", "data": { "vendor": "Joes Coffee Shop", "date": "07/29/2026", "currency": "USD", "lineItems": [ { "description": "Latte", "amount": 4.5 }, { "description": "Croissant", "amount": 3.25 } ], "subtotal": 9.5, "tax": 0.86, "total": 10.36, "warnings": [], "rawText": "Joes Coffee Shop 123 Main St…", "source": "ocr" } }

使用建议

  • 光线充足、正对拍摄的照片OCR效果显著优于倾斜或模糊照片
  • 电子发票PDF比扫描件速度更快且准确率更高,有条件时优先使用
  • 信任字段前务必检查 warnings,对于边缘布局可回退参考 rawText

应用场景

适用于费用追踪应用、会计自动化、簿记录入以及金融科技产品中的收据扫描功能。

定价方案

方案 价格
BASIC $0.00 / 月
PRO $9.99 / 月
ULTRA $99.99 / 月
MEGA $459.99 / 月

提供方信息

  • API创建者:ForCom
  • 类别:视觉识别(Visual Recognition)
  • 订阅者数量:1
二维码
社区交流群
二维码
科研交流群
商业服务