ElevenLabs v3
音訊標籤
由你掌控的語音
直接在文字中輸入 [laughs]、[whispers]、[excited] 等提示。v3 會將每個提示理解為表演指令。一次 API 呼叫即可生成多說話者場景,支援 70+ 種語言。匯出 WAV 或 MP3,再將音訊節點拖入 Zeemo 的影片工作流程。
像電影導演一樣指導聲音
一个型号,四种能力。透過 音訊標籤 進行內聯情緒控制。來自單一腳本的多揚聲器場景。跨 70+ 語言的原生韻律。 4.9%每一代的錯誤率。
寫下 [laughs],聽見笑聲自然呈現
在腳本中寫下您希望如何傳遞每一行。 [笑]、[竊竊私語]、[緩慢]、[興奮]——將它們放在類似的舞台方向上,模型就會跟隨。沒有預設下拉式選單。沒有波形編輯器。
您的腳本做主。
指導您的第一個場景貼上腳本,取得完整演員陣容
貼上帶有角色名稱的腳本。恢復完整的對話場景,其中每個聲音從第一行到最後一行都保持一致,直到 5,000 個字元。沒有縫合在一起。長場景中沒有語音漂移。
完整演員陣容。一鍵點擊。每個聲音都保留在角色中。
投射您的對話場景像當地人一樣說 70+ 種語言
講 70+ 語言,每種語言都有本地節奏和語調。日語聽起來像日語,而不是帶口音的英語。印地語有正確的重音。 音訊標籤 適用於各種語言。
真實表演。每種語言。
以 70+ 語言產生寫下一整本書,生成一個完整音訊檔案
一次產生最多 5,000 個字元。有聲書、播客劇集、訓練配音 - 編寫完整的腳本,取得一個連續的檔案。聲音自始至終保持穩定。無需拼接。無接縫。
一个文件。無接縫。寫長了。
產生長格式音訊聽聽您可以創建什麼
有聲書、視訊配音。一個模型涵蓋每個語音項目。
如何在 Zeemo 上使用 ElevenLabs v3
1
選擇模式與模型
開啟 Zeemo 無限畫布。選擇ElevenLabs v3。 TTS為一種聲音。多揚聲器場景的對話。
2
加上標籤並生成
貼上文字。在交付轉移的地方放下[笑]、[竊竊私語]、[興奮]。每個標籤控制 ~4–5 個字。無需猜測。
3
試聽並匯出
生成後直接在畫布上試聽。調整標籤即可重新生成。匯出 WAV/MP3,再將音訊節點拖入任意影片工作流程——全程在同一個畫布上完成。

