YouTube Subtitle Scraper API
收藏官方服务:
资源简介:
The YouTube Subtitle Scraper API extracts subtitles and captions from public YouTube videos in multiple languages. Retrieve timestamped transcripts, caption text, language information, and video metadata to support content analysis, SEO, translation, accessibility, AI training, and research applications.
创建时间:
2026-07-15
原始信息汇总
YouTube Subtitle Scraper API 数据集概述
核心功能
该API专注于从公开的YouTube视频中提取字幕和转录文本,支持多语言、时间戳、纯文本等输出格式,适用于内容分析、SEO、翻译、无障碍访问、AI训练和研究等场景。
主要特性
- 准确的字幕提取:获取任何YouTube视频的完整转录文本。
- 批量请求处理:通过单个POST请求同时处理多个视频URL或ID。
- 多语言支持:可包含或排除自动生成的英文字幕及非英文字幕。
- 可定制输出格式:支持纯文本或带时间戳的文本格式。
- 结构化JSON响应:返回结构化的JSON数据,便于系统集成。
- 高吞吐量限制:单次POST请求最多可处理10,000条转录行。
- 代理支持:可通过代理设置绕过区域限制。
- 状态透明度:提供清晰的错误信息和状态码,方便调试。
端点与参数
1. GET 请求(单个视频)
- 端点:
GET /v1/youtube-subtitle-scraper/ - 参数:
参数 类型 必填 描述 urlsstring 是 指定视频URL或ID include_english_agboolean 否 是否包含自动生成的英文字幕 include_non_englishboolean 否 是否包含非英文字幕 output_formatstring 否 输出格式: text或timestampmax_itemsinteger 否 最大转录行数 use_proxyboolean 否 是否使用代理
2. POST 请求(批量处理)
- 端点:
POST /v1/youtube-subtitle-scraper/ - 参数:
参数 类型 必填 描述 urlsstring[] 是 视频URL或ID数组 include_english_agboolean 否 是否包含自动生成的英文字幕 include_non_englishboolean 否 是否包含非英文字幕 output_formatstring 否 输出格式: text或timestampmax_itemsinteger 否 最大转录行数,上限10,000 use_proxyboolean 否 是否使用代理
响应示例
json { "videoId": "dQw4w9WgXcQ", "scraped_at": "2025-12-23T18:15:00.000Z", "videoUrl": "https://www.youtube.com/watch?v=dQw4w9WgXcQ", "language": "English", "content": "Sample transcript text for the video." }
技术规格
- 支持方法:GET、POST
- 认证方式:RapidAPI密钥(通过HTTP头传递)
- 速率限制:取决于订阅计划
- 响应格式:JSON
- 错误码:400(错误请求)、429(速率限制)、504(超时)
- 限制:POST请求单次最多10,000行转录内容;GET请求受URL长度限制
适用场景
- 内容创作者:增强视频SEO
- 数字营销人员:进行情感分析和定向广告
- 教育工作者与研究人员:收集和分析对话数据
- 记者:事实核查和报道
- 数据分析师:趋势发现和数据可视化
- 全球企业:多语言内容本地化
- 法律专业人士:高效筛选口语内容
使用步骤(通过RapidAPI)
- 在RapidAPI Hub上订阅
- 复制请求代码片段
- 集成到应用程序中
- 配置请求参数(如
urls、include_english_ag、output_format) - 发送请求
- 处理JSON响应
- 监控使用量
- 优化和自动化
搜集汇总
数据集介绍

背景与挑战
背景概述
YouTube Subtitle Scraper API 是一个从公开YouTube视频中提取多语言字幕和标题的接口,能够获取时间戳转录、字幕文本、语言信息及视频元数据。该工具适用于内容分析、搜索引擎优化、翻译、无障碍访问、AI训练和研究等场景。
以上内容由遇见数据集搜集并总结生成



