ElevenLabs v3
オーディオタグ
思い通りに操れる音声
[laughs][whispers][excited]を文中に入力するだけ。v3が各キューを演技指示として解釈します。1回のAPI呼び出しで複数話者のシーンを生成。70+言語に対応。WAVまたはMP3で書き出し、Zeemoの動画ワークフローに音声ノードを追加できます。
映画監督のように音声を演出
1 つのモデルで 4 つの機能。 オーディオタグによるインライン感情コントロール。単一のスクリプトからの複数のスピーカーのシーン。 70+ 言語にわたるネイティブ韻律。すべての世代で 4.9% のエラー率。
[laughs] と書けば、笑い声が自然に伝わる
各行をどのように配信するかをスクリプト内に直接記述します。 [笑い]、[ささやき]、[ゆっくり]、[興奮] — ステージの指示と同じようにそれらをドロップすると、モデルがそれに続きます。プリセットのドロップダウンはありません。波形エディタがありません。
スクリプトがショットを呼び出します。
最初のシーンを演出脚本を貼り付ければ、出演者全員が揃う
キャラクター名を含むスクリプトを貼り付けます。最初の行から最後の行まで、5,000 文字まで、すべての音声が一貫した完全な会話シーンを取り戻します。縫い合わせる必要はありません。長いシーンでも音声が途切れません。
全キャスト。ワンクリック。すべての音声がキャラクターのままです。
会話シーンをキャスト70+言語をネイティブのように話す
70+ 言語をそれぞれネイティブのリズムとイントネーションで話せます。日本語は訛りのある英語ではなく、日本語に聞こえます。ヒンディー語には適切な強調が含まれます。 オーディオタグ はあらゆる言語で動作します。
実際のパフォーマンスを示します。各言語。
70+ 言語で生成本を書けば、音声ファイル1つに
一度に最大 5,000 文字を生成します。オーディオブック、ポッドキャスト エピソード、トレーニング ナレーション — 完全なスクリプトを作成し、1 つの連続ファイルを取得します。最初から最後まで音声が安定しています。スプライシングはありません。継ぎ目なし。
1 つのファイル。縫い目はありません。長く書けます。
長編オーディオを生成作成できるものを聞く
オーディオブック、ポッドキャスト、ゲームダイアログ、ビデオナレーション。 1 つのモデルですべての音声プロジェクトをカバーします。
Zeemo で ElevenLabs v3 を使う方法
モードとモデルを選択
開く:Zeemo 無限キャンバス。 ElevenLabs v3 を選択します。 1ボイスならTTS。マルチスピーカー シーン用のダイアログ。
タグを付けて生成
テキストを貼り付けます。 [笑い]、[ささやき声]、[興奮] を配信が移行する場所にドロップします。各タグは ~4 ~ 5 ワードを制御します。推測は必要ありません。
聞く&エクスポート
生成。キャンバス上で直接聞いてください。タグを微調整して再生成します。 WAV/MP3をエクスポートします。オーディオ ノードを任意のビデオ パイプライン (同じキャンバス) にドロップします。

