跳转到主要内容

输入与输出

输入:
  • media_url
  • 源语言与目标语言
  • [可选] subtitle_url 或 ocr_text_box (以提高语音识别的准确性)
  • [可选] 术语表_ids
术语表 Pn 输出:
  • 媒体(视频或音频)
  • 翻译后的字幕_url(SRT)

工作原理

1

将您的资源托管在公开可访问的 URL

上传您的视频或音频,以及可选的字幕(.srt),以便我们的服务器可以检索它们。
2

可选提供 OCR 文本区域

如果有需要翻译的画面文本,请指定一个归一化的 OCR 框(x,y,宽度,高度),范围从 0 到 1;原点在帧的左上角。
3

使用适当的参数发送 API 请求

包括源/目标语言(例如,en‑US → zh‑CN),如有需要,包含说话人范围和导出类型。
4

等待或查询状态

使用我们的 webhook 回调或使用您的任务 ID 查询 API,直到处理完成。
5

下载输出

从提供的 URL 中检索翻译后的视频/音频和翻译后的字幕(.srt)。

使用限制

  • 仅可以创建 API 密钥的用户可以使用此 API。
  • 需要购买 Studio 方案;不允许非 Studio 用户使用。
  • 并发限制独立于口型同步;排队请求被计数。
  • 语言代码遵循 IETF BCP 47 标准,例如,en‑US。

API 错误代码

任务错误代码

源语言

注意:支持 “auto” 自动检测源语言,并在检测时更新 SourceLanguage。

注意:“auto” 支持自动检测源语言,并在检测到时更新 SourceLanguage。

目标语言

最后修改于 2026年5月26日