ElevenLabs 配音API:AI视频翻译教程

学习如何通过 SandBase 使用 ElevenLabs 配音 API,自动将视频和音频内容翻译并重新配音为 29+ 种语言。

ElevenLabs 配音API:AI视频翻译教程

你有一个优秀的视频,但它只能说一种语言,而你的受众却遍布全球。这就是 AI 配音的用武之地。ElevenLabs 的配音 API 能够翻译口语内容,并用自然流畅的语音在目标语言中重新配音,保留原始的语调、节奏和情感。通过 SandBase,你只需一次统一的 API 调用即可实现这一功能。

本教程将带你完成整个流程:从提交视频 URL 到获取完整的多语言配音版本。

什么是 AI 配音?

AI 配音是自动翻译口语音频并使用 AI 语音在不同语言中重新生成的过程。与简单的文字转语音叠加不同,现代 AI 配音能够:

  • 转录原始音频内容
  • 翻译文本到目标语言
  • 重新配音,生成匹配原始说话者语调的自然语音
  • 同步时间轴与原始视频对齐

ElevenLabs 是该领域的领先提供商之一,支持 29+ 种语言的高质量语音合成。

SandBase ElevenLabs Dubbing API page

为什么通过 SandBase 使用 ElevenLabs 配音?

SandBase 提供统一的 API 网关,简化了对各家 AI 模型的访问。你无需管理 ElevenLabs 的 API 密钥、处理其特定的认证流程或适配供应商专用的请求格式:

  • 一个 API 密钥访问所有模型(ElevenLabs、OpenAI、Runway 等)
  • 统一请求格式,跨越不同 AI 服务
  • 内置速率限制和错误处理
  • 统一的用量追踪和计费
  • 轻松集成到 AI Agent 工作流和自动化管道

ElevenLabs 配音在 SandBase 上的模型标识符为 elevenlabs/dubbing

前提条件

开始之前,你需要准备:

  1. SandBase 账号 — 在 sandbase.ai 注册
  2. SandBase API 密钥(在控制面板中获取)
  3. 需要配音的视频或音频文件 URL(公开可访问)

配音流程说明

配音工作流程如下:

  1. 提交视频/音频 URL,指定源语言和目标语言
  2. 等待处理(转录 → 翻译 → 语音合成 → 混音)
  3. 获取配音完成的输出文件

处理时间取决于内容长度。5 分钟的视频通常需要 2-4 分钟处理。

快速开始:你的第一个配音视频

使用 curl

提交配音任务的最简单方式:

curl -X POST https://api.sandbase.ai/v1/dubbing \
  -H "Authorization: Bearer YOUR_SANDBASE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "elevenlabs/dubbing",
    "source_url": "https://example.com/my-video.mp4",
    "source_language": "en",
    "target_language": "zh",
    "options": {
      "preserve_background_audio": true,
      "speaker_count": 1
    }
  }'

响应:

{
  "id": "dub_abc123xyz",
  "status": "processing",
  "estimated_duration_seconds": 180,
  "created_at": "2026-08-13T01:24:00Z"
}

查询任务状态

轮询状态端点直到处理完成:

curl https://api.sandbase.ai/v1/dubbing/dub_abc123xyz \
  -H "Authorization: Bearer YOUR_SANDBASE_API_KEY"

完成后的响应:

{
  "id": "dub_abc123xyz",
  "status": "completed",
  "output_url": "https://cdn.sandbase.ai/output/dub_abc123xyz.mp4",
  "duration_seconds": 312,
  "source_language": "en",
  "target_language": "zh",
  "created_at": "2026-08-13T01:24:00Z",
  "completed_at": "2026-08-13T01:27:42Z"
}

使用 Python

以下是完整的 Python 脚本,提交配音任务并等待结果:

import requests
import time

SANDBASE_API_KEY = "your_sandbase_api_key"
BASE_URL = "https://api.sandbase.ai/v1"

headers = {
    "Authorization": f"Bearer {SANDBASE_API_KEY}",
    "Content-Type": "application/json"
}

def dub_video(source_url: str, source_lang: str, target_lang: str) -> dict:
    """提交视频配音任务并等待结果返回。"""

    # 第一步:提交配音任务
    payload = {
        "model": "elevenlabs/dubbing",
        "source_url": source_url,
        "source_language": source_lang,
        "target_language": target_lang,
        "options": {
            "preserve_background_audio": True,
            "speaker_count": "auto"
        }
    }

    response = requests.post(
        f"{BASE_URL}/dubbing",
        headers=headers,
        json=payload
    )
    response.raise_for_status()
    job = response.json()

    print(f"任务已提交: {job['id']}")
    print(f"预计等待时间: {job['estimated_duration_seconds']}秒")

    # 第二步:轮询等待完成
    while True:
        status_response = requests.get(
            f"{BASE_URL}/dubbing/{job['id']}",
            headers=headers
        )
        status_response.raise_for_status()
        result = status_response.json()

        if result["status"] == "completed":
            print(f"完成!输出: {result['output_url']}")
            return result
        elif result["status"] == "failed":
            raise Exception(f"配音失败: {result.get('error', '未知错误')}")

        print(f"状态: {result['status']}... 等待中")
        time.sleep(10)


# 使用示例
result = dub_video(
    source_url="https://example.com/marketing-video.mp4",
    source_lang="en",
    target_lang="zh"
)

print(f"配音视频 URL: {result['output_url']}")

SandBase Dubbing API workflow diagram

支持的语言

ElevenLabs 配音支持 29+ 种语言,包括:

语言代码语言代码
英语en西班牙语es
法语fr德语de
意大利语it葡萄牙语pt
日语ja韩语ko
中文(普通话)zh印地语hi
阿拉伯语ar荷兰语nl
波兰语pl土耳其语tr
瑞典语sv印尼语id

其他支持语言包括俄语、泰语、越南语、捷克语、丹麦语、芬兰语、希腊语、匈牙利语、挪威语、罗马尼亚语和乌克兰语。

高级选项

多说话人检测

对于有多个说话人的视频,启用自动说话人检测:

payload = {
    "model": "elevenlabs/dubbing",
    "source_url": "https://example.com/interview.mp4",
    "source_language": "en",
    "target_language": "zh",
    "options": {
        "speaker_count": "auto",
        "preserve_background_audio": True,
        "preserve_music": True
    }
}

纯音频内容配音

API 同样支持音频文件 — 非常适合播客翻译:

curl -X POST https://api.sandbase.ai/v1/dubbing \
  -H "Authorization: Bearer YOUR_SANDBASE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "elevenlabs/dubbing",
    "source_url": "https://example.com/podcast-episode.mp3",
    "source_language": "en",
    "target_language": "zh",
    "options": {
      "output_format": "mp3",
      "speaker_count": 2
    }
  }'

批量配音多个视频

对于需要同时本地化多个视频的内容管道:

import concurrent.futures

videos = [
    {"url": "https://example.com/video1.mp4", "target": "es"},
    {"url": "https://example.com/video2.mp4", "target": "fr"},
    {"url": "https://example.com/video3.mp4", "target": "ja"},
]

def submit_job(video):
    payload = {
        "model": "elevenlabs/dubbing",
        "source_url": video["url"],
        "source_language": "en",
        "target_language": video["target"],
        "options": {"preserve_background_audio": True}
    }
    response = requests.post(
        f"{BASE_URL}/dubbing",
        headers=headers,
        json=payload
    )
    return response.json()

# 并行提交所有任务
with concurrent.futures.ThreadPoolExecutor(max_workers=5) as executor:
    jobs = list(executor.map(submit_job, videos))

print(f"已提交 {len(jobs)} 个配音任务")

实际应用场景

YouTube 视频本地化

通过为视频配音为受众的主要语言,扩大 YouTube 频道的覆盖范围。提交视频 URL,获取配音版本,然后上传为备用音轨或发布到本地化频道。

在线课程翻译

让教育内容走向全球。将整个课程模块配音为多种语言,同时保留讲师的教学风格和语调。

营销视频适配

在多个市场同时发起推广活动。一个英文营销视频可以在几分钟内变成西班牙语、法语、日语和德语版本。

播客翻译

将播客带给国际听众。API 在翻译到目标语言的同时,保留多个说话人之间的对话节奏。

构建完整的内容管道

真正的强大之处在于将配音与 SandBase 上可用的其他 AI API 结合使用。以下是一个生成并本地化视频的内容管道:

  1. 生成视频 — 使用 AI 视频生成 API 创建源内容
  2. 添加旁白 — 使用文字转语音为生成的视频配音
  3. 配音到目标语言 — 使用 ElevenLabs 配音进行全球化分发

这种方法让你从文本脚本到多语言的完整本地化视频,全部通过 API 调用实现。查看我们对文本转视频与图片转视频方法的比较,为你的内容选择正确的生成方式。

SandBase GPT-5.6 Luna API page

最佳实践建议

  1. 使用高质量源音频 — 清晰的语音和低背景噪音能产生更好的配音效果
  2. 指定说话人数量 — 当你知道准确数量时,帮助 AI 更准确地分离和匹配声音
  3. 将片段控制在 30 分钟以内 — 分割较长内容以获得更快的处理速度和更好的质量
  4. 保留背景音频 — 启用此选项以保持原始的音乐和音效
  5. 先用短片段测试 — 在处理完整内容之前验证质量

错误处理

在生产代码中始终处理潜在错误:

try:
    result = dub_video(source_url, "en", "zh")
except requests.exceptions.HTTPError as e:
    if e.response.status_code == 429:
        print("请求频率限制 — 稍后重试")
    elif e.response.status_code == 400:
        print(f"无效请求: {e.response.json()}")
    else:
        print(f"API 错误: {e}")
except Exception as e:
    print(f"配音失败: {e}")

定价说明

通过 SandBase 使用 ElevenLabs 配音按源音频处理的分钟数计费。请查看 SandBase 定价页面 了解当前费率。批量处理和较长内容通常比短片段有更高的性价比。

总结

AI 配音消除了内容本地化的成本和时间障碍。过去需要为每种语言聘请配音演员、翻译和音频工程师的工作,现在通过一次 API 调用即可完成。通过 SandBase,你可以在一个 API 密钥和计费系统下访问 ElevenLabs 的配音技术以及数百个其他 AI 模型。

从一个视频开始,选择目标语言,亲自体验效果。2026 年的 AI 配音质量已经非常自然,工作流程再简单不过了。


准备开始配音?注册 SandBase,获取 ElevenLabs 配音和 200+ 其他 AI 模型的 API 访问权限。