
ElevenAPI
只需幾行程式碼,即可打造生產級語音 AI
只需幾行程式碼,即可打造生產級語音 AI
只需幾行程式碼,即可打造生產級語音 AI
獲取您的 ElevenLabs API 金鑰,查看透明的 API 定價,並在數分鐘內完成您的首次呼叫。在各大財富 500 強企業中,僅需一個金鑰即可支援語音合成、聲音、語音轉文字等功能。
每月 10,000 點免費額度
完整存取所有 API
SOC 2 Type 2 與 ISO 27001 認證
聲音聽起來自然且情感豐富,並有穩定可靠的 API 作為後盾。這讓我們能夠充滿信心、順利地開拓新的語言與市場。
聲音聽起來自然且情感豐富,並有穩定可靠的 API 作為後盾。這讓我們能夠充滿信心、順利地開拓新的語言與市場。
詹庫特·科斯圖爾
Codeway 資深工程師
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") audio = client.text_to_speech.convert( voice_id="U1me6X0sIhQz6nAjDuVU", model_id="eleven_flash_v2_5", text="Your platform just found its voice.", ) # streamed audio, ~75 ms to first byte
$ curl -X POST https://api.elevenlabs.io/v1/text-to-speech/JBFqnCBsd6RMkjVDRZzb \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "text": "Your platform just found its voice.", "model_id": "eleven_flash_v2_5" }' --output speech.mp3
$ elevenlabs text-to-speech convert \ --model-id eleven_flash_v2_5 \ --voice-id 3cjtcbSfNCiKYL34TDbF \ --text "Your platform just found its voice." \ --output speech.mp3 # npm i -g @elevenlabs/cli — one command from prompt to audio
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const audio = await client.textToSpeech.convert("6ce2j5ZU8hRGBD9VwEaX", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", }); // fully typed, edge-ready
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") audio = client.text_to_speech.convert( voice_id="U1me6X0sIhQz6nAjDuVU", model_id="eleven_flash_v2_5", text="Your platform just found its voice.", ) # streamed audio, ~75 ms to first byte
$ curl -X POST https://api.elevenlabs.io/v1/text-to-speech/JBFqnCBsd6RMkjVDRZzb \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "text": "Your platform just found its voice.", "model_id": "eleven_flash_v2_5" }' --output speech.mp3
$ elevenlabs text-to-speech convert \ --model-id eleven_flash_v2_5 \ --voice-id 3cjtcbSfNCiKYL34TDbF \ --text "Your platform just found its voice." \ --output speech.mp3 # npm i -g @elevenlabs/cli — one command from prompt to audio
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const audio = await client.textToSpeech.convert("6ce2j5ZU8hRGBD9VwEaX", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", }); // fully typed, edge-ready
from elevenlabs import ElevenLabs client = ElevenLabs(api_key="sk_...") audio = client.text_to_speech.convert( voice_id="U1me6X0sIhQz6nAjDuVU", model_id="eleven_flash_v2_5", text="Your platform just found its voice.", ) # streamed audio, ~75 ms to first byte
$ curl -X POST https://api.elevenlabs.io/v1/text-to-speech/JBFqnCBsd6RMkjVDRZzb \ -H "xi-api-key: $ELEVENLABS_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "text": "Your platform just found its voice.", "model_id": "eleven_flash_v2_5" }' --output speech.mp3
$ elevenlabs text-to-speech convert \ --model-id eleven_flash_v2_5 \ --voice-id 3cjtcbSfNCiKYL34TDbF \ --text "Your platform just found its voice." \ --output speech.mp3 # npm i -g @elevenlabs/cli — one command from prompt to audio
import { ElevenLabsClient } from "elevenlabs"; const client = new ElevenLabsClient({ apiKey: process.env.ELEVENLABS_API_KEY! }); const audio = await client.textToSpeech.convert("6ce2j5ZU8hRGBD9VwEaX", { text: "Your platform just found its voice.", modelId: "eleven_flash_v2_5", }); // fully typed, edge-ready
聲音聽起來自然且情感豐富,並有穩定可靠的 API 作為後盾。這讓我們能夠充滿信心、順利地開拓新的語言與市場。
詹庫特·科斯圖爾
Codeway 資深工程師
深受全球頂尖品牌工程師的信賴
深受全球頂尖品牌工程師的信賴
獲得 10,000 個免費點數
獲得 10,000 個免費點數
獲得 10,000 個免費點數
立即使用我們領先的語音、音樂和語音辨識 API 開始構建。
立即使用我們領先的語音、音樂和語音辨識 API 開始構建。
獲取 10,000 個免費點數
免費註冊即可立即獲得 10,000 點數。無需信用卡。
獲取 10,000 個免費點數
免費註冊即可立即獲得 10,000 點數。無需信用卡。
獲取 10,000 個免費點數
免費註冊即可立即獲得 10,000 點數。無需信用卡。
取得您的 API 金鑰
從您的控制面板即可輕鬆生成 API 金鑰。內含免費版額度。
取得您的 API 金鑰
從您的控制面板即可輕鬆生成 API 金鑰。內含免費版額度。
取得您的 API 金鑰
從您的控制面板即可輕鬆生成 API 金鑰。內含免費版額度。
開始建立
只需一個請求即可傳回串流音訊。將其接入您的應用程式,即可立即上線。
開始建立
只需一個請求即可傳回串流音訊。將其接入您的應用程式,即可立即上線。
開始建立
只需一個請求即可傳回串流音訊。將其接入您的應用程式,即可立即上線。
只需一個金鑰,即可掌控您完整的音訊技術堆疊
一鍵整合您的完整音訊堆疊
只需一個金鑰,即可掌控您完整的音訊技術堆疊
獲取您的免費 API 金鑰
文字轉語音 API
以 70 多種語言生成栩栩如生的語音。使用 v3 調整情感深度,或使用 Flash v2.5 進行約 75 毫秒的推論。
文字轉語音 API
以 70 多種語言生成栩栩如生的語音。使用 v3 調整情感深度,或使用 Flash v2.5 進行約 75 毫秒的推論。
文字轉語音 API
以 70 多種語言生成栩栩如生的語音。使用 v3 調整情感深度,或使用 Flash v2.5 進行約 75 毫秒的推論。
變聲器 API
將任何聲音的音訊轉換為目標聲音,同時保留時間、語調和情感表達。
變聲器 API
將任何聲音的音訊轉換為目標聲音,同時保留時間、語調和情感表達。
變聲器 API
將任何聲音的音訊轉換為目標聲音,同時保留時間、語調和情感表達。
音樂 API
只需輸入文字提示,即可生成任何流派或風格的錄音室級 tracks。免版稅,可直接用於商業用途。
音樂 API
只需輸入文字提示,即可生成任何流派或風格的錄音室級 tracks。免版稅,可直接用於商業用途。
音樂 API
只需輸入文字提示,即可生成任何流派或風格的錄音室級 tracks。免版稅,可直接用於商業用途。
配音 API
翻譯並重新配音 90 多種語言 du 影片內容,同時保留講者的身份特徵、說話時機與語調。
配音 API
翻譯並重新配音 90 多種語言 du 影片內容,同時保留講者的身份特徵、說話時機與語調。
配音 API
翻譯並重新配音 90 多種語言 du 影片內容,同時保留講者的身份特徵、說話時機與語調。
音效 API
從文字提示詞生成音效和環境音。每次請求都會返回四個免版稅的選項。
音效 API
從文字提示詞生成音效和環境音。每次請求都會返回四個免版稅的選項。
音效 API
從文字提示詞生成音效和環境音。每次請求都會返回四個免版稅的選項。
語音引擎 API
在短短幾分鐘內為您的聊天代理程式加入擬真的人聲層。您的大型語言模型 (LLM)、檢索增強生成 (RAG) 和架構均無需做任何變動。
語音引擎 API
在短短幾分鐘內為您的聊天代理程式加入擬真的人聲層。您的大型語言模型 (LLM)、檢索增強生成 (RAG) 和架構均無需做任何變動。
語音引擎 API
在短短幾分鐘內為您的聊天代理程式加入擬真的人聲層。您的大型語言模型 (LLM)、檢索增強生成 (RAG) 和架構均無需做任何變動。
代理商 API
建構具備自然輪流發言、插話處理以及衝突降溫能力的生產級語音代理。
代理商 API
建構具備自然輪流發言、插話處理以及衝突降溫能力的生產級語音代理。
代理商 API
建構具備自然輪流發言、插話處理以及衝突降溫能力的生產級語音代理。
語音轉文字 API
以完美準確度轉錄超過 90 種語言的音訊。包含字詞級時間戳記與講者識別功能。
語音轉文字 API
以完美準確度轉錄超過 90 種語言的音訊。包含字詞級時間戳記與講者識別功能。
語音轉文字 API
以完美準確度轉錄超過 90 種語言的音訊。包含字詞級時間戳記與講者識別功能。
語音複製 API
只需不到一分鐘的音訊,即可建立即時聲音複製。您可以在所有 ElevenLabs 產品和 API 中使用它。
語音複製 API
只需不到一分鐘的音訊,即可建立即時聲音複製。您可以在所有 ElevenLabs 產品和 API 中使用它。
語音複製 API
只需不到一分鐘的音訊,即可建立即時聲音複製。您可以在所有 ElevenLabs 產品和 API 中使用它。

名列《財富》世界500強企業所信賴並部署的 API
名列《財富》世界500強企業所信賴並部署的 API
名列《財富》世界500強企業所信賴並部署的 API
SSO 和 SCIM
SAML/OIDC、基於角色的存取控制、稽核記錄
SSO 和 SCIM
SAML/OIDC、基於角色的存取控制、稽核記錄
自訂服務層級協定 (SLA)
專屬吞吐量、優先路由、隨時待命的支援工程師
資料控制
零保留、DPA(數據保護協定)、區域處理、不使用您的數據進行訓練
同意與安全工具
語音驗證和來源證明功能已內建於聲音複製 API 中
隨用隨付 API 計價
隨用隨付 API 計價
隨用隨付 API 計價
無論您的方案或用量為何,費率皆相同。無隱藏費用,亦無超額費用。
無論您的方案或用量為何,費率皆相同。無隱藏費用,亦無超額費用。
低延遲不只是一項功能,它就是整個產品的核心
低延遲不只是一項功能,它就是整個產品的核心
低延遲不只是一項功能,它就是整個產品的核心
隨生成隨串流
約 75 毫秒內即可產生首個音訊區段,在句子播完前即開始播放
專員即時客服 WebSocket
低於一秒輪替的雙向對話語音
已為您處理背壓問題
分塊傳輸、自動重試、負載下平雅降級
隨需彈性調整並行量
請求限制會隨您的層級提升而放寬,且無需管理基礎架構
我們是全球首家直接透過網路提供人工智慧功能的業者。我們正在消除藩籬:無需應用程式、不需專用裝置,也沒有繁瑣的技術門檻。
我們是全球首家直接透過網路提供人工智慧功能的業者。我們正在消除藩籬:無需應用程式、不需專用裝置,也沒有繁瑣的技術門檻。
我們是全球首家直接透過網路提供人工智慧功能的業者。我們正在消除藩籬:無需應用程式、不需專用裝置,也沒有繁瑣的技術門檻。
阿卜杜·穆德西爾
產品與技術,德國電信 / T-Mobile
由工程師為工程師打造
由工程師為工程師打造
由工程師為工程師打造
ElevenLabs 解決了機器人般、不自然的 AI 配音問題。它的 API 整合非常順暢,這使得它易於在應用程式和自動化系統中實作。
雷克斯
通過 G2 驗證的評論
ElevenLabs 解決了機器人般、不自然的 AI 配音問題。它的 API 整合非常順暢,這使得它易於在應用程式和自動化系統中實作。
雷克斯
通過 G2 驗證的評論
即使文本較長,音質依然穩定,而且 API 非常易於整合。語音自訂功能、穩定性以及低延遲,使其成為適合實際生產使用的可靠工具,而不僅僅是用於演示。
Wojciech K.
通過 G2 驗證的評論
即使文本較長,音質依然穩定,而且 API 非常易於整合。語音自訂功能、穩定性以及低延遲,使其成為適合實際生產使用的可靠工具,而不僅僅是用於演示。
Wojciech K.
通過 G2 驗證的評論
我很喜歡它非常直觀的介面,而且 API 開發也很容易上手。這是一項精緻且多元的服務,只會在您需要時才呈現您想要的工具。
亞當·B.
通過 G2 驗證的評論
我很喜歡它非常直觀的介面,而且 API 開發也很容易上手。這是一項精緻且多元的服務,只會在您需要時才呈現您想要的工具。
亞當·B.
通過 G2 驗證的評論
另一個我喜歡的新功能是增強的 API 靈活性,這使開發者能夠將 ElevenLabs 整合到更廣泛的應用程式中——從播客、有聲書到即時對話代理程式——且不會犧牲品質或響應速度。
索努·K
通過 G2 驗證的評論
另一個我喜歡的新功能是增強的 API 靈活性,這使開發者能夠將 ElevenLabs 整合到更廣泛的應用程式中——從播客、有聲書到即時對話代理程式——且不會犧牲品質或響應速度。
索努·K
通過 G2 驗證的評論
初始設定非常簡單,而且我在專案中廣泛使用了這個 API,因為我是一名 Android 和 iOS 開發人員,所以這些專案也包括英語學習應用程式和故事應用程式。
阿南德·B
通過 G2 驗證的評論
初始設定非常簡單,而且我在專案中廣泛使用了這個 API,因為我是一名 Android 和 iOS 開發人員,所以這些專案也包括英語學習應用程式和故事應用程式。
阿南德·B
通過 G2 驗證的評論
該 API 針對多種語言(包括中文和韓文)的大量檔案自動進行語音轉文字轉換的能力,直接提升了我們的團隊工作流程。
Vedaswaroop I.
通過 G2 驗證的評論
該 API 針對多種語言(包括中文和韓文)的大量檔案自動進行語音轉文字轉換的能力,直接提升了我們的團隊工作流程。
Vedaswaroop I.
通過 G2 驗證的評論
ElevenLabs 的初始設定出奇地簡單直接,讓人能快速存取 API 整合並高效生成配音。
莫哈末哈菲茲 L.
通過 G2 驗證的評論
我很喜歡 ElevenLabs 如何透過其網頁介面、API 和應用程式整合,無縫融入各種工作流程中,這使其成為無論是日常休閒還是專業用途都非常實用的全方位解決方案。
奇諾恩索·N.
通過 G2 驗證的評論
語音聽起來極其逼真,而且有很多選項可供選擇。我很欣賞能直接從文字建立語音的功能,而且 API 的回應速度快得令人印象深刻。
埃里克·C.
通過 G2 驗證的評論
ElevenLabs 的整個設定過程非常簡單且快速,包括尋找 API 金鑰,這極大地便利了我的工作流程。
盧切羅 H.
通過 G2 驗證的評論
我非常喜歡這些聲音聽起來如此自然且像真人。Text-to-Speech API 很容易與 Python 整合,而且回應時間非常快。它與我的 AI 助理專案完美搭配。
艾加·E
通過 G2 驗證的評論
語音合成功能真的很神奇,大大提升了我閱讀學術文章以及將 API 作為手機答詢助理時的體驗。
Ajibola L.
通過 G2 驗證的評論
初始設定非常簡單。從建立帳戶到成功進行第一次 API 請求,只花了大約 20 分鐘。
史考特·H
通過 G2 驗證的評論
文件寫得非常棒,讓設定變得簡單明瞭。只需要取得 API 金鑰就能大幅簡化流程。高性價比也是一大加分項。
里萬 C.
通過 G2 驗證的評論
作為一名在人工智慧新創公司工作的軟體工程師,我對 ElevenLabs 的使用體驗非常滿意。主頁面直觀易懂,而且他們的 API 文件清晰且對初學者十分友善。
艾莎·D
通過 G2 驗證的評論
我很喜歡它的整合簡易度以及整體的易游性。我非常看重語音複製 API 和使用狀況儀表板。特別令人印象深刻的是,添加情感和複製語音是如此簡單。
傑迪普 R.
通過 G2 驗證的評論
它在我們應用程式的語音回應自動化中發揮了關鍵作用,讓我們能夠將 AI 生成的文字轉換為語音,並毫無阻礙地進行大規模交付。該 API 快速、可靠,且能與其他工具完美協作,這極大地提升了我們的生產力。
李 H.
通過 G2 驗證的評論
我使用 ElevenLabs 來支援我的 AI 故事生成應用程式,而其語音品質確實賦予了這個體驗生命力。多虧了簡單的 API,整合過程非常快速。使用者經常評論旁白聽起來多麼有「人情味」,而這正是我想達到的效果。
凱文·E
通過 G2 驗證的評論
常見問題解答
常見問題解答
常見問題解答
該 REST API 擁有 Python 和 TypeScript 的官方 SDK,其文件涵蓋了串流 TTS(語音合成)、聲音複製、即時 STT(語音轉文字),以及包含工具使用和 Webhook 的完整 ElevenAgents 設定。大多數開發者在註冊後幾分鐘內即可完成首次 API 呼叫。
Flash v2.5 提供約 75 毫秒的模型推論時間,非常適合低延遲語音應用。在即時轉錄方面,Scribe v2 Realtime 的轉錄時間少於 150 毫秒。對於更注重表達力或語言廣度而非速度的使用場景,則可選擇 Eleven v3 和 Multilingual v2。
ElevenLabs 擁有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(合規證明)、GDPR(審計)和 PCI DSS Level 1 等多項認證。數據在傳輸和靜態狀態下皆經過加密。針對更嚴格的數據要求,我們也提供區域數據落地和零留存模式(Zero Retention Mode)。
Eleven v3 支援 70 多種語言。Flash v2.5(專為低延遲優化)支援 32 種語言。Dubbing v2 支援 100 多種語言。您可以從語音庫中 10,000 多個預建語音中進行選擇,或者建立您專屬的語音。
即時聲音複製只需不到一分鐘的音訊樣本即可運作。針對品牌專屬聲音或獨特的發音特徵(例如口音、音調、表達風格),「專業聲音複製」能捕捉更深層的細微差別。兩者皆可透過 API 使用,以便您以程式化方式大規模複製並提供聲音。
ElevenLabs 提供免費方案以供探索 API。付費方案依使用量計費,並提供適用於個人開發者、成長中團隊以及企業的選擇。企業方案包含客製化速率限制、服務水準協定(SLA)及專屬技術支援。
這是一個完整的平台。ElevenAgents 處理完整的對話流程——包括輪替檢測、插話處理、工具調用和即時語音——無需您自行拼湊不同的 ASR(語音識別)、TTS(語音合成)和協調服務供應商。您可以從單一平台進行代理的配置、部署和監控。
聲音品質是大多數開發人員評估 ElevenLabs 的首要原因。這些模型產生的 AI 聲音聽起來與人類錄音幾乎沒有差別——在不同的口音和語言中,都具有準確的抑揚頓挫、自然的節奏和情感範圍。針對您的使用案例,驗證這一點的最佳方法是直接透過 API 播放音訊,無需進行銷售諮詢。
我們的文件涵蓋了完整的 API 範圍 — 包括 SDK、串流(streaming)、網路鉤子(webhooks)、ElevenAgents 設定以及 Scribe。Discord 上有活躍的開發者社群提供同儕支援與回饋。付費方案包含電子郵件支援,而企業方案則包含具有明確服務水準協定(SLA)的專屬支援。
該 REST API 擁有 Python 和 TypeScript 的官方 SDK,其文件涵蓋了串流 TTS(語音合成)、聲音複製、即時 STT(語音轉文字),以及包含工具使用和 Webhook 的完整 ElevenAgents 設定。大多數開發者在註冊後幾分鐘內即可完成首次 API 呼叫。
Flash v2.5 提供約 75 毫秒的模型推論時間,非常適合低延遲語音應用。在即時轉錄方面,Scribe v2 Realtime 的轉錄時間少於 150 毫秒。對於更注重表達力或語言廣度而非速度的使用場景,則可選擇 Eleven v3 和 Multilingual v2。
ElevenLabs 擁有 SOC 2 Type 2、ISO 27001、ISO 27018、HIPAA(合規證明)、GDPR(審計)和 PCI DSS Level 1 等多項認證。數據在傳輸和靜態狀態下皆經過加密。針對更嚴格的數據要求,我們也提供區域數據落地和零留存模式(Zero Retention Mode)。
Eleven v3 支援 70 多種語言。Flash v2.5(專為低延遲優化)支援 32 種語言。Dubbing v2 支援 100 多種語言。您可以從語音庫中 10,000 多個預建語音中進行選擇,或者建立您專屬的語音。
即時聲音複製只需不到一分鐘的音訊樣本即可運作。針對品牌專屬聲音或獨特的發音特徵(例如口音、音調、表達風格),「專業聲音複製」能捕捉更深層的細微差別。兩者皆可透過 API 使用,以便您以程式化方式大規模複製並提供聲音。
ElevenLabs 提供免費方案以供探索 API。付費方案依使用量計費,並提供適用於個人開發者、成長中團隊以及企業的選擇。企業方案包含客製化速率限制、服務水準協定(SLA)及專屬技術支援。
這是一個完整的平台。ElevenAgents 處理完整的對話流程——包括輪替檢測、插話處理、工具調用和即時語音——無需您自行拼湊不同的 ASR(語音識別)、TTS(語音合成)和協調服務供應商。您可以從單一平台進行代理的配置、部署和監控。
聲音品質是大多數開發人員評估 ElevenLabs 的首要原因。這些模型產生的 AI 聲音聽起來與人類錄音幾乎沒有差別——在不同的口音和語言中,都具有準確的抑揚頓挫、自然的節奏和情感範圍。針對您的使用案例,驗證這一點的最佳方法是直接透過 API 播放音訊,無需進行銷售諮詢。
我們的文件涵蓋了完整的 API 範圍 — 包括 SDK、串流(streaming)、網路鉤子(webhooks)、ElevenAgents 設定以及 Scribe。Discord 上有活躍的開發者社群提供同儕支援與回饋。付費方案包含電子郵件支援,而企業方案則包含具有明確服務水準協定(SLA)的專屬支援。
做出能引起人們共鳴的產品
做出能引起人們共鳴的產品
做出能引起人們共鳴的產品
立即獲取 10,000 點免費額度,開始您的構建之旅。
立即獲取 10,000 點免費額度,開始您的構建之旅。