遇见数据集

sift

收藏
RapidAPI2026-09-07 更新2026-09-08 收录
官方服务:

资源简介:

PDF or Word CV in, JSON Resume out, in milliseconds. No model call on the hot path.

创建时间:
2026-09-07
原始信息汇总

数据集概述:sift

sift 是一个将简历文件转换为结构化 JSON 数据的 API 服务。它专注于高效、准确地从 PDF 或 Word(DOCX)格式的简历中提取关键信息,并以标准化的 JSON Resume 格式输出。


核心功能

  • 输入格式:支持上传 PDF 或 DOCX 文件,也支持直接传入纯文本 JSON({"text": "..."})。
  • 输出结构:返回结构化的 JSON 数据,包含以下字段:
    • 姓名
    • 邮箱
    • 电话
    • 地理位置
    • 个人主页/社交链接
    • 工作经历
    • 教育背景
    • 技能
    • 项目经历
    • 证书
    • 语言能力
  • 文件解析能力:可直接处理 PDF 中的复杂版式(如双栏布局)和 Word 表格,无需用户预先提取文本层。
  • 关键特性——覆盖率报告:每次响应均包含一个 coverage 块,明确列出已找到和未找到的字段,帮助用户识别解析盲区,避免静默返回错误信息。

技术特点

  • 无需调用模型:解析过程为确定性算法,不依赖大语言模型,因此延迟极低,响应速度以毫秒计。
  • 速度优势:由于不调用模型,相比其他基于模型的解析器,在延迟方面具有明显的竞争优势。
  • 限制说明
    • 不支持纯扫描图像型 PDF(需要 OCR 处理)。
    • 文件大小限制为 10MB。

接口端点

方法 路径 说明
POST /v1/parse 解析简历文件。支持 multipart 上传(字段名 file)或 JSON 文本输入。自动识别 PDF/DOCX 格式。
GET /v1/health 服务健康检查(liveness probe)。

定价与订阅

套餐 价格(美元/月)
BASIC $0.00
PRO $19.00
ULTRA $59.00
MEGA $179.00

其他信息

  • API 创建者:shrvan
  • 订阅者数量:2
  • 所属分类:Jobs(求职/招聘领域)
  • 当前版本:0.1.0
  • 产品网站点击访问(注意:此为页面来源地址,非额外链接)
二维码
社区交流群
二维码
科研交流群
商业服务