
ElevenAPI
只需几行代码,即可构建生产级语音 AI
只需几行代码,即可构建生产级语音 AI
只需几行代码,即可构建生产级语音 AI
获取您的 ElevenLabs API 密钥,查看透明的 API 定价,并在几分钟内完成您的首次调用。在领先的财富 500 强企业中,用一个密钥即可为文本转语音、语音、语音转文本等功能提供强劲支持。
每月 10K 免费额度
完整访问所有 API
SOC 2 Type 2 和 ISO 27001 认证
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
詹库特·科斯图尔
Codeway 高级工程师
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") audio = client.text_to_speech.convert( voice_id="U1me6X0sIhQz6nAjDuVU", model_id="eleven_flash_v2_5", text="Your platform just found its voice.", ) # streamed audio, ~75 ms to first byte
$ curl -X POST https://api.elevenlabs.io/v1/text-to-speech/JBFqnCBsd6RMkjVDRZzb \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "text": "Your platform just found its voice.", "model_id": "eleven_flash_v2_5" }' --output speech.mp3
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const audio = await client.textToSpeech.convert("3cjtcbSfNCiKYL34TDbF", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", });
import { ElevenLabsClient, type ReadableStream } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const audio: ReadableStream = await client.textToSpeech.stream("6ce2j5ZU8hRGBD9VwEaX", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", }); // fully typed, edge-ready
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") audio = client.text_to_speech.convert( voice_id="U1me6X0sIhQz6nAjDuVU", model_id="eleven_flash_v2_5", text="Your platform just found its voice.", ) # streamed audio, ~75 ms to first byte
$ curl -X POST https://api.elevenlabs.io/v1/text-to-speech/JBFqnCBsd6RMkjVDRZzb \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "text": "Your platform just found its voice.", "model_id": "eleven_flash_v2_5" }' --output speech.mp3
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const audio = await client.textToSpeech.convert("3cjtcbSfNCiKYL34TDbF", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", });
import { ElevenLabsClient, type ReadableStream } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const audio: ReadableStream = await client.textToSpeech.stream("6ce2j5ZU8hRGBD9VwEaX", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", }); // fully typed, edge-ready
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") audio = client.text_to_speech.convert( voice_id="U1me6X0sIhQz6nAjDuVU", model_id="eleven_flash_v2_5", text="Your platform just found its voice.", ) # streamed audio, ~75 ms to first byte
$ curl -X POST https://api.elevenlabs.io/v1/text-to-speech/JBFqnCBsd6RMkjVDRZzb \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "text": "Your platform just found its voice.", "model_id": "eleven_flash_v2_5" }' --output speech.mp3
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const audio = await client.textToSpeech.convert("3cjtcbSfNCiKYL34TDbF", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", });
import { ElevenLabsClient, type ReadableStream } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const audio: ReadableStream = await client.textToSpeech.stream("6ce2j5ZU8hRGBD9VwEaX", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", }); // fully typed, edge-ready
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
詹库特·科斯图尔
Codeway 高级工程师
深受全球领先品牌工程师的信赖
深受全球领先品牌工程师的信赖
获取10,000个免费积分
获取10,000个免费积分
获取10,000个免费积分
使用我们领先的语音、音乐和语音识别 API 开始构建。
使用我们领先的语音、音乐和语音识别 API 开始构建。
免费获得1万点数
免费注册即可立即获得 10,000 点积分。无需信用卡。
免费获得1万点数
免费注册即可立即获得 10,000 点积分。无需信用卡。
免费获得1万点数
免费注册即可立即获得 10,000 点积分。无需信用卡。
获取您的 API 密钥
从您的控制面板轻松生成 API 密钥。包含免费层级。
获取您的 API 密钥
从您的控制面板轻松生成 API 密钥。包含免费层级。
获取您的 API 密钥
从您的控制面板轻松生成 API 密钥。包含免费层级。
开始构建
只需一个请求即可返回流式音频。将其接入您的应用程序,即可立即上线。
开始构建
只需一个请求即可返回流式音频。将其接入您的应用程序,即可立即上线。
开始构建
只需一个请求即可返回流式音频。将其接入您的应用程序,即可立即上线。
您的完整音频栈,只需一键集成
一键解锁您的全套音频栈音频体验
您的完整音频栈,只需一键集成
免费获取您的 API 密钥
语音合成 API
生成 70 多种语言的逼真语音。使用 v3 调整情感深度,或使用 Flash v2.5 实现约 75 毫秒的超低延迟推理。

语音合成 API
生成 70 多种语言的逼真语音。使用 v3 调整情感深度,或使用 Flash v2.5 实现约 75 毫秒的超低延迟推理。

语音合成 API
生成 70 多种语言的逼真语音。使用 v3 调整情感深度,或使用 Flash v2.5 实现约 75 毫秒的超低延迟推理。

变声器 API
将任何声音的音频转换为目标声音,同时保留节奏、语调和情感表达。

变声器 API
将任何声音的音频转换为目标声音,同时保留节奏、语调和情感表达。

变声器 API
将任何声音的音频转换为目标声音,同时保留节奏、语调和情感表达。

音乐 API
通过文本提示词生成任何流派或风格的录音室级别音轨。免版税,可直接用于商业用途。

音乐 API
通过文本提示词生成任何流派或风格的录音室级别音轨。免版税,可直接用于商业用途。

音乐 API
通过文本提示词生成任何流派或风格的录音室级别音轨。免版税,可直接用于商业用途。

配音 API
翻译并重新配音 90 多种语言 des 视频内容。说话者的身份、语速和语气均得以保留。
配音 API
翻译并重新配音 90 多种语言 des 视频内容。说话者的身份、语速和语气均得以保留。
配音 API
翻译并重新配音 90 多种语言 des 视频内容。说话者的身份、语速和语气均得以保留。
音效 API
通过文本提示词生成音效和环境音。每次请求都会返回四个免版税的选择。
音效 API
通过文本提示词生成音效和环境音。每次请求都会返回四个免版税的选择。
音效 API
通过文本提示词生成音效和环境音。每次请求都会返回四个免版税的选择。
语音引擎 API
只需几分钟,即可为您的聊天智能体添加真人般的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和架构均保持不变。
语音引擎 API
只需几分钟,即可为您的聊天智能体添加真人般的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和架构均保持不变。
语音引擎 API
只需几分钟,即可为您的聊天智能体添加真人般的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和架构均保持不变。
代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。


财富500强企业首选的API平台
财富500强企业首选的API平台
财富500强企业首选的API平台
SSO 和 SCIM
SAML/OIDC、基于角色的访问控制、审计日志
SSO 和 SCIM
SAML/OIDC、基于角色的访问控制、审计日志
自定义服务等级协议 (SLA)
预留吞吐量、优先级路由、随时待命的支持工程师
数据控制
零保留、数据保护协定(DPA)、区域处理、不使用您的数据进行模型训练
同意和安全工具
语音验证和溯源技术已内置于克隆 API 中
按需付費 API 定價
按需付費 API 定價
按需付費 API 定價
无论您选择哪种计划或交易量,费率都完全相同。无隐藏费用,无超额费用。
无论您选择哪种计划或交易量,费率都完全相同。无隐藏费用,无超额费用。
低延迟并非只是一项功能,它就是整个产品的核心
低延迟并非只是一项功能,它就是整个产品的核心
低延迟并非只是一项功能,它就是整个产品的核心
随生成随流式传输
在约 75 毫秒内输出首个音频分片,在句子结束前开始播放
用于人工客服的 WebSocket
亚秒级轮替的双向会话音视频语音对话
为您自动处理背压
分块传输、自动重试以及负载下的优雅降级
根据需求弹性扩展并发
请求限制随您的等级提升而解除,无需管理基础设施
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
阿卜杜·穆德西尔
产品与技术,德国电信 / T-Mobile
由工程师为工程师打造
由工程师为工程师打造
由工程师为工程师打造
ElevenLabs 解决了机械、生硬的 AI 配音问题。API 集成很顺畅,这使其易于在应用程序和自动化系统中实现。
Rexus
已验证的 G2 评论
ElevenLabs 解决了机械、生硬的 AI 配音问题。API 集成很顺畅,这使其易于在应用程序和自动化系统中实现。
Rexus
已验证的 G2 评论
即使文本较长,质量也始终一致,而且 API 很容易集成。语音自定义、稳定性和低延迟,使它成为一个 适合生产环境使用的可靠工具,不只是用于演示。
沃伊切赫 K.
已验证的 G2 评论
即使文本较长,质量也始终一致,而且 API 很容易集成。语音自定义、稳定性和低延迟,使它成为一个 适合生产环境使用的可靠工具,不只是用于演示。
沃伊切赫 K.
已验证的 G2 评论
我喜欢它的界面非常直观,而且API 也很容易基于其进行开发。这是一个功能丰富、种类多样的服务,只有在你需要时才会展示你想要的工具。
亚当 B.
已验证的 G2 评论
我喜欢它的界面非常直观,而且API 也很容易基于其进行开发。这是一个功能丰富、种类多样的服务,只有在你需要时才会展示你想要的工具。
亚当 B.
已验证的 G2 评论
我喜欢的另一个新变化是增强后的 API 灵活性,它让开发者能够将 ElevenLabs 集成到更广泛的应用场景中——从播客和有声书到实时对话代理——同时又不会牺牲质量或响应速度。
索努·K.
已验证的 G2 评论
我喜欢的另一个新变化是增强后的 API 灵活性,它让开发者能够将 ElevenLabs 集成到更广泛的应用场景中——从播客和有声书到实时对话代理——同时又不会牺牲质量或响应速度。
索努·K.
已验证的 G2 评论
初始设置非常简单,而且我在自己的项目中大量使用这个 API,包括英语学习应用和故事应用,因为我是一名 Android 和 iOS 开发者。
阿南德 B.
已验证的 G2 评论
初始设置非常简单,而且我在自己的项目中大量使用这个 API,包括英语学习应用和故事应用,因为我是一名 Android 和 iOS 开发者。
阿南德 B.
已验证的 G2 评论
该 API 的能力可以针对包括中文和韩语在内的多种语言的大批量处理,自动进行语音转文本转换,直接提升了我们的工作流程。
维达斯瓦鲁普 I.
已验证的 G2 评论
该 API 的能力可以针对包括中文和韩语在内的多种语言的大批量处理,自动进行语音转文本转换,直接提升了我们的工作流程。
维达斯瓦鲁普 I.
已验证的 G2 评论
ElevenLabs 的初始设置令人印象深刻地简单,可以快速访问 API 集成,并高效生成旁白。
Mohdhafiz L.
已验证的 G2 评论
我很喜欢 ElevenLabs 如何通过其网页界面、API 和应用程序集成无缝融入各种工作流程,使其成为一种既适合日常使用也适合专业用途的多功能解决方案。
Chinonso N.
已验证的 G2 评论
语音听起来非常逼真,而且有很多选项可供选择。我很喜欢能够通过文本创建语音,而且 API 响应速度快得令人印象深刻。
埃里克 C.
已验证的 G2 评论
ElevenLabs 的整个设置过程都非常简单快捷,包括找到 API 密钥,这极大地促进了我的工作流程。
Lucello H.
已验证的 G2 评论
我真的很喜欢这些声音听起来如此自然、如此像真人。Text-to-Speech API 很容易与 Python 集成,而且响应时间非常快。它与我的 AI 助手项目配合得非常完美。
阿迦 E.
已验证的 G2 评论
这种文本转语音功能真的非常神奇,在阅读学术文章以及将该 API 用作我手机的应答助手时,都大大提升了我的体验。
阿吉博拉 L.
已验证的 G2 评论
初始设置非常简单。从创建账户到首次成功发出 API 请求,只用了大约 20 分钟。
斯科特 H.
已验证的 G2 评论
文档非常出色,让设置变得非常简单。只需获取一个 API 密钥,就能大大简化整个流程。高性价比也同样是一大优势。
Livan C.
已验证的 G2 评论
作为一名在 AI 初创公司工作的软件工程师,我对 ElevenLabs 的体验总体上非常积极。仪表板直观易用,他们的 API 文档清晰明了,而且对初学者很友好。
埃莎 D.
已验证的 G2 评论
我很喜欢集成有多么简单,以及整体使用起来有多么方便。我非常看重语音克隆 API 和使用情况仪表板。尤其令人印象深刻的是,添加情绪和克隆声音都如此容易。
贾迪普·R.
已验证的 G2 评论
它在自动化我们应用中的语音回复方面至关重要,使我们能够将 AI 生成的文本转换为语音,并以零摩擦的大规模方式交付。该 API 速度快、可靠,而且能与其他工具很好地协同工作,这极大提升了我们的生产效率。
Lee H.
已验证的 G2 评论
我使用 ElevenLabs 为我的 AI 故事应用提供支持,声音质量真正让整个体验鲜活起来。得益于简洁的 API,集成速度非常快。用户经常说,旁白听起来很“有人味”,这正是我想要的效果。
凯文 E.
已验证的 G2 评论
常见问题解答
常见问题解答
常见问题解答
该 REST API 拥有 Python 和 TypeScript 的官方 SDK,其文档涵盖了流式 TTS(语音合成)、声音克隆、实时 STT(语音转文字),以及包括工具使用和 Webhooks 在内的完整 ElevenAgents 设置。大多数开发者在注册后几分钟内就能完成他们的首次 API 调用。
Flash v2.5 的模型推理时间约 75 毫秒,非常适合低延迟语音应用。在实时转录方面,Scribe v2 Realtime 可以在 150 毫秒内完成转录。对于那些表现力和语言广度比速度更重要的使用场景,我们还提供了 Eleven v3 和 Multilingual v2。
ElevenLabs 拥有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(认证)、GDPR(审计)和 PCI DSS Level 1 等多项认证。数据在传输和存储过程中均进行加密。针对更严格的数据要求,我们还提供区域数据驻留和零保留模式(Zero Retention Mode)。
Eleven v3 支持 70 多种语言。Flash v2.5(针对低延迟进行了优化)支持 32 种语言。Dubbing v2 支持 100 多种语言。您可以从声音库(Voice Library)中的 10,000 多种预生成声音中进行选择,也可以创建自己的声音。
即时声音克隆只需不到一分钟的音频样本即可工作。对于品牌声音或独特的发音特征(如口音、语调、表达风格),专业声音克隆可以捕捉到更深层次的细微差别。两者均可通过 API 使用,以便您可以通过编程方式大规模克隆和提供声音。
ElevenLabs 提供免费计划以供探索 API。付费计划根据使用量进行扩缩,并提供适用于个人开发者、成长中团队以及企业级客户的选项。企业版计划包含定制的速率限制、服务等级协议(SLA)以及专属支持。
这是一个完整的平台。ElevenAgents 负责处理整个对话闭环——包括轮次检测、打断处理、工具调用和实时语音——无需您将独立的语音识别(ASR)、语音合成(TTS)以及编排服务商拼接在一起。您可以在同一个平台上配置、部署和监控智能体(agents)。
语音质量是大多数开发者最初选择评估 ElevenLabs 的原因。该模型生成的 AI 声音与人类录音几乎无异——在不同的口音和语言中都具有准确的韵律、自然的节奏和丰富的情感范围。针对您的应用场景,验证这一点最佳的方法是直接通过 API 运行音频;无需进行销售咨询。
我们的文档涵盖了完整的 API 内容——包括 SDK、流式传输、Webhooks、ElevenAgents 配置以及 Scribe。Discord 上有一个活跃的开发者社区,可提供同行支持和反馈。付费方案包含电子邮件支持,企业方案则包含具有明确 SLA 的专属支持。
该 REST API 拥有 Python 和 TypeScript 的官方 SDK,其文档涵盖了流式 TTS(语音合成)、声音克隆、实时 STT(语音转文字),以及包括工具使用和 Webhooks 在内的完整 ElevenAgents 设置。大多数开发者在注册后几分钟内就能完成他们的首次 API 调用。
Flash v2.5 的模型推理时间约 75 毫秒,非常适合低延迟语音应用。在实时转录方面,Scribe v2 Realtime 可以在 150 毫秒内完成转录。对于那些表现力和语言广度比速度更重要的使用场景,我们还提供了 Eleven v3 和 Multilingual v2。
ElevenLabs 拥有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(认证)、GDPR(审计)和 PCI DSS Level 1 等多项认证。数据在传输和存储过程中均进行加密。针对更严格的数据要求,我们还提供区域数据驻留和零保留模式(Zero Retention Mode)。
Eleven v3 支持 70 多种语言。Flash v2.5(针对低延迟进行了优化)支持 32 种语言。Dubbing v2 支持 100 多种语言。您可以从声音库(Voice Library)中的 10,000 多种预生成声音中进行选择,也可以创建自己的声音。
即时声音克隆只需不到一分钟的音频样本即可工作。对于品牌声音或独特的发音特征(如口音、语调、表达风格),专业声音克隆可以捕捉到更深层次的细微差别。两者均可通过 API 使用,以便您可以通过编程方式大规模克隆和提供声音。
ElevenLabs 提供免费计划以供探索 API。付费计划根据使用量进行扩缩,并提供适用于个人开发者、成长中团队以及企业级客户的选项。企业版计划包含定制的速率限制、服务等级协议(SLA)以及专属支持。
这是一个完整的平台。ElevenAgents 负责处理整个对话闭环——包括轮次检测、打断处理、工具调用和实时语音——无需您将独立的语音识别(ASR)、语音合成(TTS)以及编排服务商拼接在一起。您可以在同一个平台上配置、部署和监控智能体(agents)。
语音质量是大多数开发者最初选择评估 ElevenLabs 的原因。该模型生成的 AI 声音与人类录音几乎无异——在不同的口音和语言中都具有准确的韵律、自然的节奏和丰富的情感范围。针对您的应用场景,验证这一点最佳的方法是直接通过 API 运行音频;无需进行销售咨询。
我们的文档涵盖了完整的 API 内容——包括 SDK、流式传输、Webhooks、ElevenAgents 配置以及 Scribe。Discord 上有一个活跃的开发者社区,可提供同行支持和反馈。付费方案包含电子邮件支持,企业方案则包含具有明确 SLA 的专属支持。
发布人们能听到的产品
发布人们能听到的产品
发布人们能听到的产品
获取 10,000 个免费额度,立即开始构建。
获取 10,000 个免费额度,立即开始构建。