
会话代理 API
通过电话、聊天和 WhatsApp 构建生产级语音智能体
通过电话、聊天和 WhatsApp 构建生产级语音智能体
通过电话、聊天和 WhatsApp 构建生产级语音智能体
用于 AI 电话代理、客服语音和外呼 AI 语音代理的对话式 AI API 和 SDK。ElevenAgents 在您自己的大语言模型(LLM)和技术栈上运行完整的循环——包括轮流发言、中断处理、工具调用和实时语音。
每月 10K 免费额度
完整访问所有 API
SOC 2 Type 2 和 ISO 27001 认证
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
詹库特·科斯图尔
Codeway 高级工程师
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") agent = client.conversational_ai.agents.create( name="Support agent", conversation_config={ "agent": {"prompt": {"prompt": "You are a friendly support agent."}}, "tts": {"voice_id": "JBFqnCBsd6RMkjVDRZzb"}, }, ) # then connect over WebSocket for live audio
$ curl -X POST https://api.elevenlabs.io/v1/convai/agents/create \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "name": "Support agent", "conversation_config": { "agent": {"prompt": {"prompt": "You are a friendly support agent."}}, "tts": {"voice_id": "JBFqnCBsd6RMkjVDRZzb"} } }'
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const agent = await client.conversationalAi.agents.create({ name: "Support agent", conversationConfig: { agent: { prompt: { prompt: "You are a friendly support agent." } }, tts: { voiceId: "JBFqnCBsd6RMkjVDRZzb" }, }, });
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const agent = await client.conversationalAi.agents.create({ name: "Support agent", conversationConfig: { agent: { prompt: { prompt: "You are a friendly support agent." } }, tts: { voiceId: "JBFqnCBsd6RMkjVDRZzb" }, }, }); // connect over WebSocket for the live conversation loop
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") agent = client.conversational_ai.agents.create( name="Support agent", conversation_config={ "agent": {"prompt": {"prompt": "You are a friendly support agent."}}, "tts": {"voice_id": "JBFqnCBsd6RMkjVDRZzb"}, }, ) # then connect over WebSocket for live audio
$ curl -X POST https://api.elevenlabs.io/v1/convai/agents/create \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "name": "Support agent", "conversation_config": { "agent": {"prompt": {"prompt": "You are a friendly support agent."}}, "tts": {"voice_id": "JBFqnCBsd6RMkjVDRZzb"} } }'
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const agent = await client.conversationalAi.agents.create({ name: "Support agent", conversationConfig: { agent: { prompt: { prompt: "You are a friendly support agent." } }, tts: { voiceId: "JBFqnCBsd6RMkjVDRZzb" }, }, });
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const agent = await client.conversationalAi.agents.create({ name: "Support agent", conversationConfig: { agent: { prompt: { prompt: "You are a friendly support agent." } }, tts: { voiceId: "JBFqnCBsd6RMkjVDRZzb" }, }, }); // connect over WebSocket for the live conversation loop
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") agent = client.conversational_ai.agents.create( name="Support agent", conversation_config={ "agent": {"prompt": {"prompt": "You are a friendly support agent."}}, "tts": {"voice_id": "JBFqnCBsd6RMkjVDRZzb"}, }, ) # then connect over WebSocket for live audio
$ curl -X POST https://api.elevenlabs.io/v1/convai/agents/create \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "name": "Support agent", "conversation_config": { "agent": {"prompt": {"prompt": "You are a friendly support agent."}}, "tts": {"voice_id": "JBFqnCBsd6RMkjVDRZzb"} } }'
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY, }); const agent = await client.conversationalAi.agents.create({ name: "Support agent", conversationConfig: { agent: { prompt: { prompt: "You are a friendly support agent." } }, tts: { voiceId: "JBFqnCBsd6RMkjVDRZzb" }, }, });
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const agent = await client.conversationalAi.agents.create({ name: "Support agent", conversationConfig: { agent: { prompt: { prompt: "You are a friendly support agent." } }, tts: { voiceId: "JBFqnCBsd6RMkjVDRZzb" }, }, }); // connect over WebSocket for the live conversation loop
声音听起来自然且富有情感,并配有稳固可靠的 API。这让我们能够满怀信心地拓展新语言和新市场。
詹库特·科斯图尔
Codeway 高级工程师
深受全球领先品牌工程师的信赖
深受全球领先品牌工程师的信赖
获取10,000个免费积分
获取10,000个免费积分
获取10,000个免费积分
无论您是在原型化您的首个语音代理,还是在整个组织中扩展人工智能。
无论您是在原型化您的首个语音代理,还是在整个组织中扩展人工智能。
免费注册,立得 10,000 点赠送额度。无需信用卡。
免费注册,立得 10,000 点赠送额度。无需信用卡。
免费注册,立得 10,000 点赠送额度。无需信用卡。
从您的控制面板轻松生成 API 密钥。包含免费层级。
从您的控制面板轻松生成 API 密钥。包含免费层级。
从您的控制面板轻松生成 API 密钥。包含免费层级。
一个请求即可返回流式音频。将其接入您的应用程序,即可实现实时播报。
一个请求即可返回流式音频。将其接入您的应用程序,即可实现实时播报。
一个请求即可返回流式音频。将其接入您的应用程序,即可实现实时播报。
您的完整音频栈,只需一键集成
您的完整音频栈,只需一键集成
您的完整音频栈,只需一键集成
免费获取您的 API 密钥
代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

代理 API
构建具备自然轮流发言、打断处理和冲突缓解能力的生产级语音智能体。

语音合成 API
生成 70 多种语言的逼真语音。使用 v3 进行情感深度微调,或使用 Flash v2.5 进行约 75 毫秒的超快推理。

语音合成 API
生成 70 多种语言的逼真语音。使用 v3 进行情感深度微调,或使用 Flash v2.5 进行约 75 毫秒的超快推理。

语音合成 API
生成 70 多种语言的逼真语音。使用 v3 进行情感深度微调,或使用 Flash v2.5 进行约 75 毫秒的超快推理。

变声器 API
将任何声音的音频转换成目标声音,同时保留节奏、语调和情感表达。

变声器 API
将任何声音的音频转换成目标声音,同时保留节奏、语调和情感表达。

变声器 API
将任何声音的音频转换成目标声音,同时保留节奏、语调和情感表达。

只需输入文本提示,即可生成任何流派或风格的录音室级别高品质乐曲。免版税,可直接用于商业用途。
只需输入文本提示,即可生成任何流派或风格的录音室级别高品质乐曲。免版税,可直接用于商业用途。
只需输入文本提示,即可生成任何流派或风格的录音室级别高品质乐曲。免版税,可直接用于商业用途。
通过文本提示词生成音效和环境音。每次点播都会返回四个免版税选项。
通过文本提示词生成音效和环境音。每次点播都会返回四个免版税选项。
通过文本提示词生成音效和环境音。每次点播都会返回四个免版税选项。
语音设计 API
用通俗易懂 lower-cased 的语言描述一种声音,并在几秒钟内生成一个全新的、专属的声音。在每一个 ElevenAPI 界面中都可以使用它。

语音设计 API
用通俗易懂 lower-cased 的语言描述一种声音,并在几秒钟内生成一个全新的、专属的声音。在每一个 ElevenAPI 界面中都可以使用它。

语音设计 API
用通俗易懂 lower-cased 的语言描述一种声音,并在几秒钟内生成一个全新的、专属的声音。在每一个 ElevenAPI 界面中都可以使用它。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

语音转文本 API
以完美的准确率转录90多种语言的音频。包含字级时间戳和发言人识别。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

声音克隆 API
使用不到一分钟的音频,即可创建即时声音克隆。可在所有 ElevenLabs 产品和 API 中使用。

翻译并重新配音 90 多种语言 des 视频内容。说话者的身份特征、语速节奏及语气均能完美保留。
翻译并重新配音 90 多种语言 des 视频内容。说话者的身份特征、语速节奏及语气均能完美保留。
翻译并重新配音 90 多种语言 des 视频内容。说话者的身份特征、语速节奏及语气均能完美保留。
在短短几分钟内为您的聊天代理添加人性化的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和系统架构将保持原样。
在短短几分钟内为您的聊天代理添加人性化的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和系统架构将保持原样。
在短短几分钟内为您的聊天代理添加人性化的语音层。您的大语言模型(LLM)、检索增强生成(RAG)和系统架构将保持原样。

财富500强企业首选的API平台
财富500强企业首选的API平台
财富500强企业首选的API平台
SSO 和 SCIM
SAML/OIDC、基于角色的访问控制、审计日志
自定义服务等级协议 (SLA)
预留吞吐量、优先级路由、随时待命的支持工程师
数据控制
零保留、数据保护协定(DPA)、区域处理、不使用您的数据进行模型训练
同意和安全工具
语音验证和溯源技术已内置于克隆 API 中
按需付費 API 定價
按需付費 API 定價
按需付費 API 定價
无论您选择哪种计划或交易量,费率都完全相同。无隐藏费用,无超额费用。
无论您选择哪种计划或交易量,费率都完全相同。无隐藏费用,无超额费用。
领先的 AI 电话代理,专为生产环境打造
领先的 AI 电话代理,专为生产环境打造
领先的 AI 电话代理,专为生产环境打造
完整的语音智能体平台
一个 API 即可搞定语音识别(ASR)、语音合成(TTS)和流程编排
用于实时智能体的对话式人工智能语音 API
亚秒级轮替的双向会话音视频语音对话
语音智能体 API 和 SDK
使用您偏好的语言,包括 Python 和 TypeScript
为您的人工智能代理克隆声音
为您的智能体定制品牌或个性化声音
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
我们是世界上首家直接通过网络提供人工智能功能的机构。我们正在消除障碍。无需应用程序,无需特殊设备,也无需复杂的技术。
阿卜杜·穆德西尔
产品与技术,德国电信 / T-Mobile
由工程师为工程师打造
由工程师为工程师打造
由工程师为工程师打造
ElevenLabs 解决了机械、生硬的 AI 配音问题。API 集成很顺畅,这使其易于在应用程序和自动化系统中实现。
Rexus
已验证的 G2 评论
ElevenLabs 解决了机械、生硬的 AI 配音问题。API 集成很顺畅,这使其易于在应用程序和自动化系统中实现。
Rexus
已验证的 G2 评论
即使文本较长,质量也始终一致,而且 API 很容易集成。语音自定义、稳定性和低延迟,使它成为一个 适合生产环境使用的可靠工具,不只是用于演示。
沃伊切赫 K.
已验证的 G2 评论
即使文本较长,质量也始终一致,而且 API 很容易集成。语音自定义、稳定性和低延迟,使它成为一个 适合生产环境使用的可靠工具,不只是用于演示。
沃伊切赫 K.
已验证的 G2 评论
我喜欢它的界面非常直观,而且API 也很容易基于其进行开发。这是一个功能丰富、种类多样的服务,只有在你需要时才会展示你想要的工具。
亚当 B.
已验证的 G2 评论
我喜欢它的界面非常直观,而且API 也很容易基于其进行开发。这是一个功能丰富、种类多样的服务,只有在你需要时才会展示你想要的工具。
亚当 B.
已验证的 G2 评论
我喜欢的另一个新变化是增强后的 API 灵活性,它让开发者能够将 ElevenLabs 集成到更广泛的应用场景中——从播客和有声书到实时对话代理——同时又不会牺牲质量或响应速度。
索努·K.
已验证的 G2 评论
我喜欢的另一个新变化是增强后的 API 灵活性,它让开发者能够将 ElevenLabs 集成到更广泛的应用场景中——从播客和有声书到实时对话代理——同时又不会牺牲质量或响应速度。
索努·K.
已验证的 G2 评论
初始设置非常简单,而且我在自己的项目中大量使用这个 API,包括英语学习应用和故事应用,因为我是一名 Android 和 iOS 开发者。
阿南德 B.
已验证的 G2 评论
初始设置非常简单,而且我在自己的项目中大量使用这个 API,包括英语学习应用和故事应用,因为我是一名 Android 和 iOS 开发者。
阿南德 B.
已验证的 G2 评论
该 API 的能力可以针对包括中文和韩语在内的多种语言的大批量处理,自动进行语音转文本转换,直接提升了我们的工作流程。
维达斯瓦鲁普 I.
已验证的 G2 评论
该 API 的能力可以针对包括中文和韩语在内的多种语言的大批量处理,自动进行语音转文本转换,直接提升了我们的工作流程。
维达斯瓦鲁普 I.
已验证的 G2 评论
ElevenLabs 的初始设置令人印象深刻地简单,可以快速访问 API 集成,并高效生成旁白。
Mohdhafiz L.
已验证的 G2 评论
我很喜欢 ElevenLabs 如何通过其网页界面、API 和应用程序集成无缝融入各种工作流程,使其成为一种既适合日常使用也适合专业用途的多功能解决方案。
Chinonso N.
已验证的 G2 评论
语音听起来非常逼真,而且有很多选项可供选择。我很喜欢能够通过文本创建语音,而且 API 响应速度快得令人印象深刻。
埃里克 C.
已验证的 G2 评论
ElevenLabs 的整个设置过程都非常简单快捷,包括找到 API 密钥,这极大地促进了我的工作流程。
Lucello H.
已验证的 G2 评论
我真的很喜欢这些声音听起来如此自然、如此像真人。Text-to-Speech API 很容易与 Python 集成,而且响应时间非常快。它与我的 AI 助手项目配合得非常完美。
阿迦 E.
已验证的 G2 评论
这种文本转语音功能真的非常神奇,在阅读学术文章以及将该 API 用作我手机的应答助手时,都大大提升了我的体验。
阿吉博拉 L.
已验证的 G2 评论
初始设置非常简单。从创建账户到首次成功发出 API 请求,只用了大约 20 分钟。
斯科特 H.
已验证的 G2 评论
文档非常出色,让设置变得非常简单。只需获取一个 API 密钥,就能大大简化整个流程。高性价比也同样是一大优势。
Livan C.
已验证的 G2 评论
作为一名在 AI 初创公司工作的软件工程师,我对 ElevenLabs 的体验总体上非常积极。仪表板直观易用,他们的 API 文档清晰明了,而且对初学者很友好。
埃莎 D.
已验证的 G2 评论
我很喜欢集成有多么简单,以及整体使用起来有多么方便。我非常看重语音克隆 API 和使用情况仪表板。尤其令人印象深刻的是,添加情绪和克隆声音都如此容易。
贾迪普·R.
已验证的 G2 评论
它在自动化我们应用中的语音回复方面至关重要,使我们能够将 AI 生成的文本转换为语音,并以零摩擦的大规模方式交付。该 API 速度快、可靠,而且能与其他工具很好地协同工作,这极大提升了我们的生产效率。
Lee H.
已验证的 G2 评论
我使用 ElevenLabs 为我的 AI 故事应用提供支持,声音质量真正让整个体验鲜活起来。得益于简洁的 API,集成速度非常快。用户经常说,旁白听起来很“有人味”,这正是我想要的效果。
凯文 E.
已验证的 G2 评论
常见问题解答
常见问题解答
常见问题解答
创建一个智能体,将其指向您的大语言模型(LLM),选择一个声音,并通过 WebSocket 连接进行实时音频交互。支持呼入和呼出电话。
是的——同一个代理可同时驱动呼入客户服务语音和呼出 AI 语音代理,并针对实时对话进行了轮流发言和打断处理的优化。此外,也可在 WhatsApp 上使用。
Flash v2.5 的模型推理时间约为 75 毫秒,非常适合低延迟语音应用。对于实时转写,Scribe v2 Realtime 可以在 150 毫秒内完成转写。对于在表达力或语言广度方面要求高于速度的使用场景,则可以使用 Eleven v3 和 Multilingual v2。
ElevenLabs 拥有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(合规证明)、GDPR(审计)以及 PCI DSS Level 1 等多项认证。数据在传输和静态存储中均进行加密。对于有更严格数据要求的用户,我们还提供区域数据驻留和零保留模式(Zero Retention Mode)。
Eleven v3 支持 70 多种语言。Flash v2.5(针对低延迟进行了优化)支持 32 种语言。Dubbing v2 支持 90 多种语言。您可以从声音库(Voice Library)中的 10,000 多种预设声音中进行选择,也可以创建自己的声音。
是的 - 将智能体与声音克隆 API 结合使用,即可通过编程方式为其提供品牌专属或定制的声音。
ElevenLabs 提供免费计划以供探索 API。付费计划根据使用量进行扩缩,并为个人开发者、成长型团队和企业提供不同选项。企业版包括自定义速率限制、服务等级协议(SLA)和专属支持。
这是一个完整的平台。ElevenAgents 处理完整的对话循环——轮流检测、打断处理、工具调用和实时语音——无需您将独立的 ASR(语音识别)、TTS(语音合成)和编排服务商拼凑在一起。您可以在同一个平台上配置、部署和监控智能体。
语音质量是大多数开发者最初选择评估 ElevenLabs 的原因。其模型生成的 AI 语音听起来几乎与人类录音无异——跨越不同口音和语言,都具有准确的韵律、自然的节奏和丰富的情感范围。在您的应用场景中验证这一点的最佳方式是直接通过 API 运行音频;无需进行销售沟通。
我们的文档涵盖了完整的 API 领域——包括 SDK、流媒体、Webhook、ElevenAgents 配置以及 Scribe。Discord 上有一个活跃的开发者社区,可提供同行支持和反馈。付费计划包含电子邮件支持,企业计划则包含具有明确 SLA 的专属支持。
创建一个智能体,将其指向您的大语言模型(LLM),选择一个声音,并通过 WebSocket 连接进行实时音频交互。支持呼入和呼出电话。
是的——同一个代理可同时驱动呼入客户服务语音和呼出 AI 语音代理,并针对实时对话进行了轮流发言和打断处理的优化。此外,也可在 WhatsApp 上使用。
Flash v2.5 的模型推理时间约为 75 毫秒,非常适合低延迟语音应用。对于实时转写,Scribe v2 Realtime 可以在 150 毫秒内完成转写。对于在表达力或语言广度方面要求高于速度的使用场景,则可以使用 Eleven v3 和 Multilingual v2。
ElevenLabs 拥有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(合规证明)、GDPR(审计)以及 PCI DSS Level 1 等多项认证。数据在传输和静态存储中均进行加密。对于有更严格数据要求的用户,我们还提供区域数据驻留和零保留模式(Zero Retention Mode)。
Eleven v3 支持 70 多种语言。Flash v2.5(针对低延迟进行了优化)支持 32 种语言。Dubbing v2 支持 90 多种语言。您可以从声音库(Voice Library)中的 10,000 多种预设声音中进行选择,也可以创建自己的声音。
是的 - 将智能体与声音克隆 API 结合使用,即可通过编程方式为其提供品牌专属或定制的声音。
ElevenLabs 提供免费计划以供探索 API。付费计划根据使用量进行扩缩,并为个人开发者、成长型团队和企业提供不同选项。企业版包括自定义速率限制、服务等级协议(SLA)和专属支持。
这是一个完整的平台。ElevenAgents 处理完整的对话循环——轮流检测、打断处理、工具调用和实时语音——无需您将独立的 ASR(语音识别)、TTS(语音合成)和编排服务商拼凑在一起。您可以在同一个平台上配置、部署和监控智能体。
语音质量是大多数开发者最初选择评估 ElevenLabs 的原因。其模型生成的 AI 语音听起来几乎与人类录音无异——跨越不同口音和语言,都具有准确的韵律、自然的节奏和丰富的情感范围。在您的应用场景中验证这一点的最佳方式是直接通过 API 运行音频;无需进行销售沟通。
我们的文档涵盖了完整的 API 领域——包括 SDK、流媒体、Webhook、ElevenAgents 配置以及 Scribe。Discord 上有一个活跃的开发者社区,可提供同行支持和反馈。付费计划包含电子邮件支持,企业计划则包含具有明确 SLA 的专属支持。
发布人们能听到的产品
发布人们能听到的产品
发布人们能听到的产品
获取 10,000 个免费额度,立即开始构建。
获取 10,000 个免费额度,立即开始构建。