遇见数据集

YouTube Transcript, Subtitle & Metadata API

收藏
RapidAPI2026-08-21 更新2026-08-22 收录
官方服务:

资源简介:

Extract YouTube transcripts, subtitles, metadata, chapters, and thumbnails as JSON, text, SRT, VTT, Markdown, or LLM-ready chunks with durable jobs.

创建时间:
2026-08-21
原始信息汇总

YouTube Transcript, Subtitle & Metadata API 数据集详情

数据集概述

该API提供可靠的YouTube字幕提取功能,无需Google API密钥。它能够提取YouTube已有的手动或自动字幕轨道,并以多种格式输出结构化数据,包括字幕、元数据、章节和缩略图等信息。需要说明的是,该API仅提取YouTube已提供的字幕轨道,不提供视频无字幕时的语音转文本功能。

核心功能

  • 多格式输出:支持JSON、纯文本、SRT、VTT、Markdown和LLM-ready JSON六种输出格式
  • 持久化任务:任务可跨部署和临时上游故障存活,具备自动重试和重复保护机制
  • 批量处理:支持批量创建最多10个视频的字幕任务
  • 高效轮询:支持长轮询以减少状态请求次数
  • 灵活下载:支持HTTP字节范围断点续传,提供短期有效的签名结果URL
  • Webhook通知:支持签名完成通知,且可重放终态webhook
  • 数据发现:提供字幕语言、视频/频道元数据、章节和缩略图等发现功能

使用场景

适用于需要提取YouTube视频字幕、构建AI代理、进行视频内容分析等场景,特别适合需要结构化、LLM-ready输出的开发者。

任务工作流

  1. 可选:通过语言接口检查可用字幕轨道
  2. 创建持久化任务(POST /api/v2/youtube/transcript/jobs)
  3. 轮询任务状态或接收签名webhook
  4. 任务完成后下载结果或请求签名结果URL

数据字段与参数

字段 说明 默认值
url 公开YouTube视频或Shorts URL 必填
format 输出格式 json
language 可选语言标签(如en 自动
source 字幕来源 preferred
chunkSize LLM分块目标字符数(500-12,000) 4,000
callbackUrl 公共HTTPS webhook URL 可选

语言选择逻辑:优先手动英文字幕,其次是自动英文字幕,最后是第一个可用的手动或自动轨道。

应用场景与限制

  • 适用于需要从YouTube视频中提取字幕和元数据的各类应用,如AI内容分析、视频归档、多语言内容处理等
  • API仅处理有权使用的内容,需遵守YouTube条款和适用法律
  • 当特定字幕选择不可用时,返回422 TRANSCRIPT_NOT_AVAILABLE永久错误

可靠性规则

  • 每个逻辑请求需发送稳定的唯一Idempotency-Key
  • 相同键和请求体重放返回相同任务;相同键但不同请求体返回409
  • 优先使用长轮询而非频繁状态轮询
  • 遵循Retry-After响应头
  • 在结果过期前完成下载或复制

定价订阅

  • BASIC:$0.00 / 月
  • PRO:$10.99 / 月
  • ULTRA:$45.99 / 月
  • MEGA:$85.99 / 月

性能指标

  • 服务级别:100%
  • 延迟:821ms
  • 测试成功率:100%

创作者信息

  • API创建者:PDPRO
  • 分类:视频、图片
  • 订阅者数:1
二维码
社区交流群
二维码
科研交流群
商业服务