ElevenLabs v3 オーディオタグ
思い通りに操れる音声

[laughs][whispers][excited]を文中に入力するだけ。v3が各キューを演技指示として解釈します。1回のAPI呼び出しで複数話者のシーンを生成。70+言語に対応。WAVまたはMP3で書き出し、Zeemoの動画ワークフローに音声ノードを追加できます。

Zeemo で ElevenLabs v3 を試す
ElevenLabs v3 オーディオ波形
4.9%
エラー率を備えた AI Text to Speech
27 カテゴリおよび 8 言語全体で、15.3% からダウン (68% エラーが v2 よりも少ない)。
70+
言語
あらゆる言語で実行されます。音声学だけでなく、文化的なスピーチ パターン。
5K
通話ごとの文字数
Text-to-Dialogue API は、1 世代でマルチスピーカー シーンを処理します。

映画監督のように音声を演出

1 つのモデルで 4 つの機能。 オーディオタグによるインライン感情コントロール。単一のスクリプトからの複数のスピーカーのシーン。 70+ 言語にわたるネイティブ韻律。すべての世代で 4.9% のエラー率。

[laughs] と書けば、笑い声が自然に伝わる

各行をどのように配信するかをスクリプト内に直接記述します。 [笑い]、[ささやき]、[ゆっくり]、[興奮] — ステージの指示と同じようにそれらをドロップすると、モデルがそれに続きます。プリセットのドロップダウンはありません。波形エディタがありません。

スクリプトがショットを呼び出します。

最初のシーンを演出
オーディオタグ 波形視覚化

脚本を貼り付ければ、出演者全員が揃う

キャラクター名を含むスクリプトを貼り付けます。最初の行から最後の行まで、5,000 文字まで、すべての音声が一貫した完全な会話シーンを取り戻します。縫い合わせる必要はありません。長いシーンでも音声が途切れません。

全キャスト。ワンクリック。すべての音声がキャラクターのままです。

会話シーンをキャスト
マルチスピーカー対話波形

70+言語をネイティブのように話す

70+ 言語をそれぞれネイティブのリズムとイントネーションで話せます。日本語は訛りのある英語ではなく、日本語に聞こえます。ヒンディー語には適切な強調が含まれます。 オーディオタグ はあらゆる言語で動作します。

実際のパフォーマンスを示します。各言語。

70+ 言語で生成
70+ 言語の視覚化

本を書けば、音声ファイル1つに

一度に最大 5,000 文字を生成します。オーディオブック、ポッドキャスト エピソード、トレーニング ナレーション — 完全なスクリプトを作成し、1 つの連続ファイルを取得します。最初から最後まで音声が安定しています。スプライシングはありません。継ぎ目なし。

1 つのファイル。縫い目はありません。長く書けます。

長編オーディオを生成
長編音声生成

作成できるものを聞く

オーディオブック、ポッドキャスト、ゲームダイアログ、ビデオナレーション。 1 つのモデルですべての音声プロジェクトをカバーします。

オーディオブックとナレーション
0:00 0:00

オーディオブックとナレーション

オーディオタグで感情を重ねます。世界構築には[ゆっくり]、アクションには[緊張]、秘密には[ささやき]。本がパフォーマンスになる

ポッドキャストとスクリプト
0:00 0:00

ポッドキャストとスクリプト

1 つのスクリプト、複数の音声。ホスト、ゲスト、広告読み取り - それぞれが区別されます。自然なペース。スタジオなし。

ビデオ ゲーム ダイアログ
0:00 0:00

ビデオ ゲーム ダイアログ

キャラクターのようなNPC。クエストギバー、悪役、サイドキック - それぞれが独自の声を持っています。ダイアログ API により一貫性が保たれます。

ビデオ ナレーション
0:00 0:00

ビデオ ナレーション

ナレーションを生成し、95+ 言語でキャプションを追加し、オーディオをビデオ パイプラインにドロップします。 1 つのワークフロー、開始から終了まで。

Zeemo で ElevenLabs v3 を使う方法

1

モードとモデルを選択

開く:Zeemo 無限キャンバス。 ElevenLabs v3 を選択します。 1ボイスならTTS。マルチスピーカー シーン用のダイアログ。

2

タグを付けて生成

テキストを貼り付けます。 [笑い]、[ささやき声]、[興奮] を配信が移行する場所にドロップします。各タグは ~4 ~ 5 ワードを制御します。推測は必要ありません。

3

聞く&エクスポート

生成。キャンバス上で直接聞いてください。タグを微調整して再生成します。 WAV/MP3をエクスポートします。オーディオ ノードを任意のビデオ パイプライン (同じキャンバス) にドロップします。

多くの クリエイターに選ばれ、支持されています

よくある
質問

ElevenLabs v3 は、インラインを備えたテキスト読み上げモデルです。マルチスピーカーシーン用の オーディオタグ および Text-to-Dialogue API。 3月発売の2026。 70+言語。 4.9% のエラー率は 15.3% から低下しました。 Zeemo 無限キャンバスで利用可能。Zeemo の

Zeemo にサインアップし、無限キャンバス を開いて、ElevenLabs v3 を選択します。 TTS またはダイアログ モードを選択し、オーディオタグ でスクリプトを作成し、. 料金プランを見る →

オーディオタグ は、[笑い]、[ささやき声]、[興奮]、[ゆっくり] など、スクリプトに書き込むインライン キューです。各タグは、およそ次の 4 ~ 5 ワードの配信を制御します。オーディオ編集は必要ありません。

API の価格は、1,000 キャラクターあたり $0.12 から始まります。 Pro のプランは、100K キャラクターで月額 ~$22 です。 Zeemo は、同じキャンバス上の他の AI モデルと ElevenLabs v3 をバンドルしています。 料金プランを見る →

No. Zeemo で生成された音声にはウォーターマークは含まれません。あなたのナレーション。あなたのブランド。 料金プランを見る →

ElevenLabs v3
Zeemo で今すぐ始める!

始めましょうGoogle Play App Store
作成を始める
ElevenLabs v3