
配音 API
只需一次调用,即可用90多种语言对视频进行配音和翻译
只需一次调用,即可用90多种语言对视频进行配音和翻译
只需一次调用,即可用90多种语言对视频进行配音和翻译
ElevenLabs Dubbing API 支持 90 多种语言的视频和音频重配——这是一款 AI 配音和视频翻译 API,能够保留说话者的身份特征、语气以及原本的时间轴节奏。专为大规模视频本地化而生。
每月 10K 免费额度
完整访问所有 API
SOC 2 Type 2 和 ISO 27001 认证
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
詹库特·科斯图尔
Codeway 高级工程师
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") dub = client.dubbing.create( file=open("source.mp4", "rb"), target_lang="es", ) # returns dubbing_id — poll status, then download
$ curl -X POST https://api.elevenlabs.io/v1/dubbing \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -F target_lang="fr" \ -F file=@source.mp4
import { ElevenLabsClient } from "elevenlabs"; import fs from "fs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const dub = await client.dubbing.create({ file: fs.createReadStream("source.mp4"), targetLang: "ja", });
import { ElevenLabsClient } from "elevenlabs"; import fs from "fs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const dub = await client.dubbing.create({ file: fs.createReadStream("source.mp4"), targetLang: "de", }); // async — poll dubbing_id for the finished render
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") dub = client.dubbing.create( file=open("source.mp4", "rb"), target_lang="es", ) # returns dubbing_id — poll status, then download
$ curl -X POST https://api.elevenlabs.io/v1/dubbing \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -F target_lang="fr" \ -F file=@source.mp4
import { ElevenLabsClient } from "elevenlabs"; import fs from "fs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const dub = await client.dubbing.create({ file: fs.createReadStream("source.mp4"), targetLang: "ja", });
import { ElevenLabsClient } from "elevenlabs"; import fs from "fs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const dub = await client.dubbing.create({ file: fs.createReadStream("source.mp4"), targetLang: "de", }); // async — poll dubbing_id for the finished render
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") dub = client.dubbing.create( file=open("source.mp4", "rb"), target_lang="es", ) # returns dubbing_id — poll status, then download
$ curl -X POST https://api.elevenlabs.io/v1/dubbing \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -F target_lang="fr" \ -F file=@source.mp4
import { ElevenLabsClient } from "elevenlabs"; import fs from "fs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const dub = await client.dubbing.create({ file: fs.createReadStream("source.mp4"), targetLang: "ja", });
import { ElevenLabsClient } from "elevenlabs"; import fs from "fs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const dub = await client.dubbing.create({ file: fs.createReadStream("source.mp4"), targetLang: "de", }); // async — poll dubbing_id for the finished render
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
詹库特·科斯图尔
Codeway 高级工程师
深受全球领先品牌工程师的信赖
深受全球领先品牌工程师的信赖
获取10,000个免费积分
获取10,000个免费积分
获取10,000个免费积分
开始使用我们领先的语音、音乐和演讲 API 进行构建。
开始使用我们领先的语音、音乐和演讲 API 进行构建。
免费注册,立得 10,000 点赠送额度。无需信用卡。
免费注册,立得 10,000 点赠送额度。无需信用卡。
免费注册,立得 10,000 点赠送额度。无需信用卡。
从您的控制面板轻松生成 API 密钥。包含免费层级。
从您的控制面板轻松生成 API 密钥。包含免费层级。
从您的控制面板轻松生成 API 密钥。包含免费层级。
一个请求即可返回流式音频。将其接入您的应用程序,即可实现实时播报。
一个请求即可返回流式音频。将其接入您的应用程序,即可实现实时播报。
一个请求即可返回流式音频。将其接入您的应用程序,即可实现实时播报。
只需3步,即可实现大规模配音
只需3步,即可实现大规模配音
只需3步,即可实现大规模配音
无需将语音识别(ASR)、翻译、TTS 或同步流水线拼接在一起。只需发起一次请求便能启动整个工作流,并返回完成的配音。



向配音接口发送 POST 请求,提供视频、音频文件或源 URL。支持源音频、源文本和目标文本。
向配音接口发送 POST 请求,提供视频、音频文件或源 URL。支持源音频、源文本和目标文本。
向配音接口发送 POST 请求,提供视频、音频文件或源 URL。支持源音频、源文本和目标文本。
传入一个或多个(支持90多种语言)作为参数。只需设置一次,即可将单一源内容分发传输给任意多个目标。
传入一个或多个(支持90多种语言)作为参数。只需设置一次,即可将单一源内容分发传输给任意多个目标。
传入一个或多个(支持90多种语言)作为参数。只需设置一次,即可将单一源内容分发传输给任意多个目标。
翻译、声音克隆和时间同步均在服务器端自动运行。制作完成的配音只需几分钟即可准备就绪。
翻译、声音克隆和时间同步均在服务器端自动运行。制作完成的配音只需几分钟即可准备就绪。
翻译、声音克隆和时间同步均在服务器端自动运行。制作完成的配音只需几分钟即可准备就绪。
您的完整音频栈,只需一键集成
您的完整音频栈,只需一键集成
您的完整音频栈,只需一键集成
免费获取您的 API 密钥
配音 API
在 90 多种语言之间翻译视频内容并进行重新配音。同时保留说话者的声音特色、语速节奏及语气。

配音 API
在 90 多种语言之间翻译视频内容并进行重新配音。同时保留说话者的声音特色、语速节奏及语气。

配音 API
在 90 多种语言之间翻译视频内容并进行重新配音。同时保留说话者的声音特色、语速节奏及语气。

语音合成 API
生成超 70 种语言的逼真语音。使用 v3 调节情感深度,或使用 Flash v2.5 实现约 75 毫秒的超低延迟推理。

语音合成 API
生成超 70 种语言的逼真语音。使用 v3 调节情感深度,或使用 Flash v2.5 实现约 75 毫秒的超低延迟推理。

语音合成 API
生成超 70 种语言的逼真语音。使用 v3 调节情感深度,或使用 Flash v2.5 实现约 75 毫秒的超低延迟推理。

变声器 API
将任何声音的音频转换成目标声音,同时保留节奏、语调和情感表达。

变声器 API
将任何声音的音频转换成目标声音,同时保留节奏、语调和情感表达。

变声器 API
将任何声音的音频转换成目标声音,同时保留节奏、语调和情感表达。

只需输入文本提示,即可生成任何流派或风格的录音室级品质轨道。免版税,可直接商用。
只需输入文本提示,即可生成任何流派或风格的录音室级品质轨道。免版税,可直接商用。
只需输入文本提示,即可生成任何流派或风格的录音室级品质轨道。免版税,可直接商用。
通过文本提示词生成音效和环境音。每次请求都会生成四个无版权的使用方案。
通过文本提示词生成音效和环境音。每次请求都会生成四个无版权的使用方案。
通过文本提示词生成音效和环境音。每次请求都会生成四个无版权的使用方案。
代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

用通俗易懂 crater 的语言描述一种声音,并在数秒内生成全新的、独家拥有的声音。可在每个 ElevenAPI 界面上使用它。
用通俗易懂 crater 的语言描述一种声音,并在数秒内生成全新的、独家拥有的声音。可在每个 ElevenAPI 界面上使用它。
用通俗易懂 crater 的语言描述一种声音,并在数秒内生成全新的、独家拥有的声音。可在每个 ElevenAPI 界面上使用它。
在短短几分钟内为您的聊天代理添加人性化的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和系统架构将保持原样。
在短短几分钟内为您的聊天代理添加人性化的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和系统架构将保持原样。
在短短几分钟内为您的聊天代理添加人性化的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和系统架构将保持原样。

财富500强企业首选的API平台
财富500强企业首选的API平台
财富500强企业首选的API平台
SSO 和 SCIM
SAML/OIDC、基于角色的访问控制、审计日志
自定义服务等级协议 (SLA)
预留吞吐量、优先级路由、随时待命的支持工程师
数据控制
零保留、数据保护协定(DPA)、区域处理、不使用您的数据进行模型训练
同意和安全工具
语音验证和溯源技术已内置于克隆 API 中
按需付費 API 定價
按需付費 API 定價
按需付費 API 定價
无论您选择哪种计划或交易量,费率都完全相同。无隐藏费用,无超额费用。
无论您选择哪种计划或交易量,费率都完全相同。无隐藏费用,无超额费用。
本地化不是一个功能,它就是整个产品本身
本地化不是一个功能,它就是整个产品本身
本地化不是一个功能,它就是整个产品本身
AI 视频翻译 API
一键完成视频和音频的翻译与重配音
语音本地化 API
在保留说话人身份特征的同时,触达每一个市场
节奏与语气得以保留
涵盖 90 多种语言及细微方言差异
根据需求弹性扩展并发
请求限制随您的等级提升而解除,无需管理基础设施
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
阿卜杜·穆德西尔
产品与技术,德国电信 / T-Mobile
由工程师为工程师打造
由工程师为工程师打造
由工程师为工程师打造
ElevenLabs 解决了机械、生硬的 AI 配音问题。API 集成很顺畅,这使其易于在应用程序和自动化系统中实现。
Rexus
已验证的 G2 评论
ElevenLabs 解决了机械、生硬的 AI 配音问题。API 集成很顺畅,这使其易于在应用程序和自动化系统中实现。
Rexus
已验证的 G2 评论
即使文本较长,质量也始终一致,而且 API 很容易集成。语音自定义、稳定性和低延迟,使它成为一个 适合生产环境使用的可靠工具,不只是用于演示。
沃伊切赫 K.
已验证的 G2 评论
即使文本较长,质量也始终一致,而且 API 很容易集成。语音自定义、稳定性和低延迟,使它成为一个 适合生产环境使用的可靠工具,不只是用于演示。
沃伊切赫 K.
已验证的 G2 评论
我喜欢它的界面非常直观,而且API 也很容易基于其进行开发。这是一个功能丰富、种类多样的服务,只有在你需要时才会展示你想要的工具。
亚当 B.
已验证的 G2 评论
我喜欢它的界面非常直观,而且API 也很容易基于其进行开发。这是一个功能丰富、种类多样的服务,只有在你需要时才会展示你想要的工具。
亚当 B.
已验证的 G2 评论
我喜欢的另一个新变化是增强后的 API 灵活性,它让开发者能够将 ElevenLabs 集成到更广泛的应用场景中——从播客和有声书到实时对话代理——同时又不会牺牲质量或响应速度。
索努·K.
已验证的 G2 评论
我喜欢的另一个新变化是增强后的 API 灵活性,它让开发者能够将 ElevenLabs 集成到更广泛的应用场景中——从播客和有声书到实时对话代理——同时又不会牺牲质量或响应速度。
索努·K.
已验证的 G2 评论
初始设置非常简单,而且我在自己的项目中大量使用这个 API,包括英语学习应用和故事应用,因为我是一名 Android 和 iOS 开发者。
阿南德 B.
已验证的 G2 评论
初始设置非常简单,而且我在自己的项目中大量使用这个 API,包括英语学习应用和故事应用,因为我是一名 Android 和 iOS 开发者。
阿南德 B.
已验证的 G2 评论
该 API 的能力可以针对包括中文和韩语在内的多种语言的大批量处理,自动进行语音转文本转换,直接提升了我们的工作流程。
维达斯瓦鲁普 I.
已验证的 G2 评论
该 API 的能力可以针对包括中文和韩语在内的多种语言的大批量处理,自动进行语音转文本转换,直接提升了我们的工作流程。
维达斯瓦鲁普 I.
已验证的 G2 评论
ElevenLabs 的初始设置令人印象深刻地简单,可以快速访问 API 集成,并高效生成旁白。
Mohdhafiz L.
已验证的 G2 评论
我很喜欢 ElevenLabs 如何通过其网页界面、API 和应用程序集成无缝融入各种工作流程,使其成为一种既适合日常使用也适合专业用途的多功能解决方案。
Chinonso N.
已验证的 G2 评论
语音听起来非常逼真,而且有很多选项可供选择。我很喜欢能够通过文本创建语音,而且 API 响应速度快得令人印象深刻。
埃里克 C.
已验证的 G2 评论
ElevenLabs 的整个设置过程都非常简单快捷,包括找到 API 密钥,这极大地促进了我的工作流程。
Lucello H.
已验证的 G2 评论
我真的很喜欢这些声音听起来如此自然、如此像真人。Text-to-Speech API 很容易与 Python 集成,而且响应时间非常快。它与我的 AI 助手项目配合得非常完美。
阿迦 E.
已验证的 G2 评论
这种文本转语音功能真的非常神奇,在阅读学术文章以及将该 API 用作我手机的应答助手时,都大大提升了我的体验。
阿吉博拉 L.
已验证的 G2 评论
初始设置非常简单。从创建账户到首次成功发出 API 请求,只用了大约 20 分钟。
斯科特 H.
已验证的 G2 评论
文档非常出色,让设置变得非常简单。只需获取一个 API 密钥,就能大大简化整个流程。高性价比也同样是一大优势。
Livan C.
已验证的 G2 评论
作为一名在 AI 初创公司工作的软件工程师,我对 ElevenLabs 的体验总体上非常积极。仪表板直观易用,他们的 API 文档清晰明了,而且对初学者很友好。
埃莎 D.
已验证的 G2 评论
我很喜欢集成有多么简单,以及整体使用起来有多么方便。我非常看重语音克隆 API 和使用情况仪表板。尤其令人印象深刻的是,添加情绪和克隆声音都如此容易。
贾迪普·R.
已验证的 G2 评论
它在自动化我们应用中的语音回复方面至关重要,使我们能够将 AI 生成的文本转换为语音,并以零摩擦的大规模方式交付。该 API 速度快、可靠,而且能与其他工具很好地协同工作,这极大提升了我们的生产效率。
Lee H.
已验证的 G2 评论
我使用 ElevenLabs 为我的 AI 故事应用提供支持,声音质量真正让整个体验鲜活起来。得益于简洁的 API,集成速度非常快。用户经常说,旁白听起来很“有人味”,这正是我想要的效果。
凯文 E.
已验证的 G2 评论
常见问题解答
常见问题解答
常见问题解答
该 REST API 拥有 Python 和 TypeScript 的官方 SDK,其文档涵盖了流式 TTS(从文本到语音)、声音克隆、实时 STT(从语音到文本)以及包括工具使用和 Webhook 在内的完整 ElevenAgents 设置。大多数开发者在注册后几分钟内就能完成他们的首次 API 调用。
Flash v2.5 提供了约 75 毫秒的模型推理时间,非常适合低延迟语音应用。对于实时转录,Scribe v2 Realtime 可以在 150 毫秒内完成转录。对于那些表现力或语言广度比速度更重要的使用场景,我们还提供了 Eleven v3 和 Multilingual v2。
ElevenLabs 拥有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(守规证明)、GDPR(审计)和 PCI DSS Level 1 等多项认证。数据在传输和存储时均经过加密。针对更严格的数据要求,我们还支持区域数据本地化保留和零留存模式(Zero Retention Mode)。
是的 - 我们的配音 API 支持 100 多种语言的视频本地化,同时保留每位说话者的身份特征、语速节奏和语气,让单个源视频即可实现全球发布。
即时声音克隆只需不到一分钟的样本音频。对于品牌声音或独特的发音特征(如口音、语气、表达风格),专业声音克隆能捕捉到更深层次的细微差别。两者均可通过 API 接入,以便您能够以编程方式进行大规模的克隆和声音分发。
ElevenLabs 提供免费计划以供探索 API。付费计划根据使用量进行扩容,并提供适合个人开发者、成长中团队以及企业的多种选择。企业版包含自定义速率限制、服务等级协议(SLA)以及专属支持。
这是一个完整的平台。ElevenAgents 处理完整的对话流——包括轮替检测、打断处理、工具调用和实时语音——无需您将独立的语音识别(ASR)、语音合成(TTS)和编排服务商拼接在一起。您可以在同一个平台内配置、部署和监控智能体。
语音质量是大多数开发者最初选择评估 ElevenLabs 的原因。这些模型生成的 AI 语音听起来与人类录音几乎无异——在不同的口音和语言中都具有准确的韵律、自然的停顿和丰富的情感表现力。在您的应用场景中验证这一点的最佳方式是直接通过 API 运行音频;无需进行销售沟通。
我们的文档涵盖了完整的 API 范畴 — 包括 SDK、流式传输、Webhook、ElevenAgents 配置以及 Scribe。Discord 上有一个活跃的开发者社区,可提供同行支持和反馈。付费计划包含电子邮件支持,企业计划则包含具有明确 SLA 的专属支持。
该 REST API 拥有 Python 和 TypeScript 的官方 SDK,其文档涵盖了流式 TTS(从文本到语音)、声音克隆、实时 STT(从语音到文本)以及包括工具使用和 Webhook 在内的完整 ElevenAgents 设置。大多数开发者在注册后几分钟内就能完成他们的首次 API 调用。
Flash v2.5 提供了约 75 毫秒的模型推理时间,非常适合低延迟语音应用。对于实时转录,Scribe v2 Realtime 可以在 150 毫秒内完成转录。对于那些表现力或语言广度比速度更重要的使用场景,我们还提供了 Eleven v3 和 Multilingual v2。
ElevenLabs 拥有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(守规证明)、GDPR(审计)和 PCI DSS Level 1 等多项认证。数据在传输和存储时均经过加密。针对更严格的数据要求,我们还支持区域数据本地化保留和零留存模式(Zero Retention Mode)。
是的 - 我们的配音 API 支持 100 多种语言的视频本地化,同时保留每位说话者的身份特征、语速节奏和语气,让单个源视频即可实现全球发布。
即时声音克隆只需不到一分钟的样本音频。对于品牌声音或独特的发音特征(如口音、语气、表达风格),专业声音克隆能捕捉到更深层次的细微差别。两者均可通过 API 接入,以便您能够以编程方式进行大规模的克隆和声音分发。
ElevenLabs 提供免费计划以供探索 API。付费计划根据使用量进行扩容,并提供适合个人开发者、成长中团队以及企业的多种选择。企业版包含自定义速率限制、服务等级协议(SLA)以及专属支持。
这是一个完整的平台。ElevenAgents 处理完整的对话流——包括轮替检测、打断处理、工具调用和实时语音——无需您将独立的语音识别(ASR)、语音合成(TTS)和编排服务商拼接在一起。您可以在同一个平台内配置、部署和监控智能体。
语音质量是大多数开发者最初选择评估 ElevenLabs 的原因。这些模型生成的 AI 语音听起来与人类录音几乎无异——在不同的口音和语言中都具有准确的韵律、自然的停顿和丰富的情感表现力。在您的应用场景中验证这一点的最佳方式是直接通过 API 运行音频;无需进行销售沟通。
我们的文档涵盖了完整的 API 范畴 — 包括 SDK、流式传输、Webhook、ElevenAgents 配置以及 Scribe。Discord 上有一个活跃的开发者社区,可提供同行支持和反馈。付费计划包含电子邮件支持,企业计划则包含具有明确 SLA 的专属支持。
发布人们能听到的产品
发布人们能听到的产品
发布人们能听到的产品
获取 10,000 个免费额度,立即开始构建。
获取 10,000 个免费额度,立即开始构建。