全球代理网络运行正常 为爬虫工程师与 AI 数据团队提供服务
首页/AI 数据方案/YouTube 采集 API
YOUTUBE DATA API

通过 API 获取 YouTube元数据、字幕与评论

提交视频 ID 或公开 URL,获取元数据、字幕与评论;长任务通过异步状态和 Webhook 交付,需要媒体文件时可按项目配置对象存储。

REST API / JSON异步任务 / Webhook字幕 / 评论 / 元数据S3 / OSS / GCS 交付
YouTube 数据任务接口就绪
YouTube 采集 API123Proxy data network
视频元数据METADATA
字幕与转录SUBTITLES
评论与回复COMMENTS
媒体文件OBJECT STORAGE
API 请求REQUEST
异步任务JOB
Webhook / 存储DELIVERY
接口方式REST / JSON
任务模式同步 / 异步
结果交付Webhook / Storage
REST API标准 JSON 接口
ASYNC JOB批量异步任务
WEBHOOK任务完成通知
S3 / OSS / GCS对象存储交付
01 / 接口能力

REST API、异步任务与 Webhook

提交视频 ID 或公开 URL,获取任务状态、JSON 结果和对象存储交付。

视频元数据

按视频 ID 或公开 URL 请求标题、描述、标签及公开统计字段。

字幕与转录

请求可用字幕、语言与时间信息,具体字段以正式 API 文档为准。

评论与回复

按任务拉取公开评论与回复,保留层级、时间和可用公开字段。

对象存储交付

媒体文件可按项目直接交付至 S3、OSS 或 GCS,格式与分辨率需测试确认。

02 / 适用任务

视频知识库、多模态语料与评论数据

把长耗时任务放入异步队列,通过 job_id、状态和 Webhook 与现有数据管道衔接。

01

视频知识库与 RAG

获取公开元数据、字幕和来源字段,形成可追踪的视频文档。

重点:字段与来源
02

多模态数据任务

把视频、音频、字幕与元数据交付到同一对象关系中。

重点:对象关联
03

评论与社区研究

按视频任务采集公开评论和回复,保留层级与时间字段。

重点:结构完整性
03 / 任务流程

任务提交、异步处理与结果交付

轻量字段可同步返回,批量评论和媒体任务通过 job_id、Webhook 或对象存储交付。

01
定义任务与字段

提交视频 ID、公开 URL、所需字段和交付方式。

02
使用 API Key 鉴权

在请求头传递密钥,并使用幂等键避免重复创建任务。

03
轮询或接收 Webhook

保存 job_id,依据状态处理运行、完成与失败。

04
校验 JSON 与存储对象

核对字段、对象关系、错误信息和媒体交付结果。

API job architecture123Proxy network
API 客户端REQUEST
任务队列JOB
采集服务WORKERS
Webhook / 存储DELIVERY
接口REST / JSON
执行模式同步 / 异步
结果交付Webhook / Storage
04 / API 产品

YouTube 采集 API

通过统一接口提交任务、查询状态并接收结果,无需单独维护 YouTube 代理池和下载集群。

API PRODUCT

YouTube 采集 API

视频 ID / 公开 URL 任务提交元数据、字幕与评论字段批量异步任务与 Webhook对象存储交付按项目确认
鉴权API Key建议通过请求头传递并妥善保管
任务模式同步 / 异步轻量查询与长耗时任务分离
结果格式JSON / Webhook状态、结果与错误可追踪
媒体交付S3 / OSS / GCS格式、分辨率与存储权限按项目确认
05 / 运行指标

API 运行指标

监控任务创建率、完成率、处理时延、字段完整性、Webhook 投递和对象存储写入。

任务创建成功率
通过鉴权和参数校验并返回 job_id 的任务比例
任务完成率
在约定时间窗内进入完成状态的任务比例
处理时延
按任务类型分别观察 P50、P95 与长尾完成时间
字段完整性
所需元数据、字幕、评论及关系字段的可用比例
Webhook 投递
回调成功、重试与重复事件的处理结果
对象交付完整性
目标存储中媒体对象、元数据与任务记录的一致性

接口字段、任务配额、媒体格式、分辨率、响应时间及平台可用性以正式 API 文档和实际测试结果为准。

06 / 接入代码

Python 异步任务示例

API Key 通过请求头传递,客户端持久化 job_id,并通过轮询或 Webhook 获取结果。

API Key 通过请求头传递使用幂等键避免重复任务持久化 job_id、状态与错误
Python / async task接入示例
import requests

response = requests.post(
    "https://api.123proxy.cn/v1/youtube/video",
    headers={"X-API-Key": "YOUR_API_KEY"},
    json={
        "video_id": "VIDEO_ID",
        "features": ["metadata", "subtitles", "comments"],
        "delivery": {
            "webhook_url": "https://collector.example/webhooks/youtube",
            "upload_to": "s3://my-bucket/videos/"
        },
        "idempotency_key": "dataset-2026-0001"
    },
    timeout=30,
)
response.raise_for_status()
job = response.json()
print(job["job_id"], job["status"])
07 / FAQ

YouTube 采集 API 常见问题

字段、异步任务、Webhook、对象存储、配额与错误处理。

API 可以返回哪些 YouTube 数据?

原页面覆盖视频元数据、字幕或转录、公开评论与回复。正式可用字段、排序参数、语言和分页方式以开通后的 API 文档为准。

哪些请求同步返回,哪些需要异步任务?

轻量元数据请求可能直接返回;深度评论、批量视频和媒体文件交付通常更适合异步任务。具体阈值和状态字段以正式文档为准。

支持将音视频直接传到 S3、OSS 或 GCS 吗?

原页面包含对象存储直传能力。实际支持的存储类型、格式、分辨率、凭证方式和文件命名应在项目测试中确认。

接入 API 后还需要自行购买和维护代理吗?

不需要为该 API 单独维护代理池。123Proxy 封装数据访问和任务执行,客户系统仍需负责合法任务输入、结果校验、存储和数据治理。

如何避免重复创建或重复处理任务?

客户端应为业务任务提供幂等键,持久化 job_id,并把 Webhook 当作可能重试的事件处理;具体签名与重试规则以正式文档为准。

如何申请 API Key 和测试额度?

联系销售并提交数据类型、任务量、所需字段、媒体交付方式和完成周期,确认测试范围后开通 API Key 与配额。

遇到限流或临时失败应该怎么处理?

按返回状态和错误码执行指数退避,限制客户端并发并记录重试次数。正式配额、速率限制和错误码以 API 文档为准。

使用范围和合规边界是什么?

仅处理依法可访问且具有合理使用依据的公开内容,并遵守平台条款、知识产权、隐私和适用法律;API 不用于绕过登录、验证码或访问控制。

申请 YouTube 采集 API 测试

提交视频样本、字段清单、日任务量、Webhook 或对象存储需求。