ElevenLabs v3 오디오 태그
원하는 대로 연출하는 음성

텍스트 안에 [laughs], [whispers], [excited]를 직접 입력하세요. v3는 각 태그를 연기 지시로 해석합니다. 한 번의 API 호출로 여러 화자가 등장하는 장면을 생성하고, 70+개 언어를 지원합니다. WAV 또는 MP3로 내보낸 뒤 Zeemo 동영상 워크플로에 오디오 노드를 추가하세요.

Zeemo에서 ElevenLabs v3를 사용해 보세요
ElevenLabs v3 오디오 파형
4.9%
오류율
15.3%에서 다운(68%보다 오류가 적음 v2) 27 카테고리 및 8 언어 전반에 걸쳐 사용됩니다.
70+
언어
모든 언어에서 작동합니다. 단순한 음성학이 아닌 문화적 음성 패턴.
5K
통화당 문자
Text-to-Dialogue API는 한 세대에 다중 스피커 장면을 처리합니다.

영화감독처럼 음성을 연출하세요

하나의 모델, 4가지 기능. 오디오 태그를 통한 인라인 감정 제어. 단일 스크립트의 다중 화자 장면. 70+ 언어 전반에 걸친 네이티브 운율. 모든 세대의 4.9% 오류율.

[laughs]라고 쓰면 웃음이 자연스럽게 살아납니다

스크립트에서 바로 각 줄을 전달하려는 방식을 작성하세요. [웃음], [속삭임], [천천히], [흥분] — 같은 무대 방향으로 놓으면 모델이 따라옵니다. 사전 설정된 드롭다운이 없습니다. 파형 편집기가 없습니다.

스크립트가 샷을 호출합니다.

첫 번째 장면 연출하기
오디오 태그 파형 시각화

스크립트를 붙여 넣고 전체 출연진을 받아 보세요

문자 이름과 함께 스크립트를 붙여넣으세요. 최대 5,000 문자까지 모든 음성이 첫 번째 줄부터 마지막 ​​줄까지 일관되게 유지되는 전체 대화 장면을 다시 가져옵니다. 바느질이 함께 필요하지 않습니다. 긴 장면에서도 음성 드리프트가 없습니다.

풀캐스트. 한 번의 클릭. 모든 음성은 문자 그대로 유지됩니다.

대화 장면을 캐스팅하세요
멀티 스피커 대화 파형

70+개 언어를 현지인처럼 말하세요

각각 고유의 리듬과 억양이 있는 70+ 언어를 사용하세요. 일본어는 억양이 있는 영어가 아닌 일본어로 들립니다. 힌디어는 올바른 강세를 전달합니다. 오디오 태그는 모든 언어에서 작동합니다.

실제 성능. 모든 언어.

70+ 언어로 생성
70+ 언어 시각화

책 한 권을 쓰고 하나의 오디오 파일로 받아 보세요

한 번에 최대 5,000자를 생성합니다. 오디오북, 팟캐스트 에피소드, 교육 음성 해설 — 전체 스크립트를 작성하고 하나의 연속 파일을 받으세요. 음성은 처음부터 끝까지 안정적으로 유지됩니다. 접합이 없습니다. 이음새가 없습니다.

파일 하나. 솔기가 없습니다. 길게 쓰세요.

장형 오디오 생성
장형 오디오 생성

만들 수 있는 내용을 들어보세요

오디오북, 팟캐스트, 게임 대화, 비디오 음성 해설. 하나의 모델이 모든 음성 프로젝트를 포괄합니다.

오디오북 및 내레이션
0:00 0:00

오디오북 및 내레이션

오디오 태그로 레이어 감정을 표현해보세요. [느리게] 세계 건설을 위해, [긴장] 행동을 위해, [속삭임] 비밀을 위해. 책이 공연이 됩니다.

팟캐스트 및 대본 프로그램
0:00 0:00

팟캐스트 및 대본 프로그램

하나의 스크립트, 여러 음성. 호스트, 게스트, 광고 읽기 - 각각 고유하게 유지됩니다. 자연스러운 속도. 스튜디오 없음.

비디오 게임 대화
0:00 0:00

비디오 게임 대화

NPC가 캐릭터처럼 느껴집니다. 퀘스트 제공자, 악당, 조수 등 각자의 목소리가 있습니다. API 대화는 일관성을 유지합니다. Zeemo의

비디오 음성 해설
0:00 0:00

비디오 음성 해설

음성 해설을 생성하고, 95+ 언어로 캡션을 추가하고, 비디오 파이프라인에 오디오를 추가하세요. 하나의 워크플로로 시작부터 끝까지.

Zeemo에서 ElevenLabs v3 사용하는 방법

1

모드 및 모델 선택

열기: Zeemo 무한 캔버스. ElevenLabs v3를 선택하세요. 하나의 목소리를 위한 TTS. 다중 스피커 장면에 대한 대화.

2

태그 및 생성

텍스트를 붙여넣습니다. 배달이 바뀌는 곳에 [웃음], [속삭임], [흥분]을 놓으십시오. 각 태그는 ~4~5 단어를 제어합니다. 추측할 필요가 없습니다.

3

Listen & Import

생성합니다. 캔버스에서 바로 들어보세요. 태그를 조정하고 재생성하세요. WAV/MP3를 내보냅니다. 동일한 캔버스에 오디오 노드를 놓습니다.

많은 크리에이터가 선택하고 지지합니다

자주 묻는
질문

ElevenLabs v3는 인라인 오디오 태그 및 다중 스피커 장면을 위한 Text-to-Dialogue API. 3월 2026 출시. 70+ 언어. 15.3%보다 4.9%의 오류율이 낮아졌습니다. Zeemo의 캔버스에서 사용 가능합니다. Zeemo의

Zeemo에 가입하고 AI 무한 캔버스를 열고 ElevenLabs v3를 선택하세요. TTS 또는 대화 모드를 선택하고 오디오 태그로 스크립트를 작성한 다음 생성합니다. 요금제 보기 →

오디오 태그는 [웃음], [속삭임], [흥분] 또는 [느림]과 같이 스크립트에 작성하는 인라인 단서입니다. 각 태그는 대략 다음 4-5 단어의 전달을 제어합니다. 오디오 편집이 필요하지 않습니다.

API 가격은 1,000 문자당 $0.12부터 시작됩니다. 100K 캐릭터에 대한 프로 플랜은 ~$22/월입니다. Zeemo는 동일한 캔버스에 다른 AI 모델과 함께 ElevenLabs v3를 번들로 제공합니다. 요금제 보기 →

No. Zeemo에서 생성된 오디오에는 워터마크가 없습니다. 당신의 음성 해설. 당신의 브랜드. 요금제 보기 →

시도 ElevenLabs v3
지금 Zeemo에서 시작하세요!

Google Play App Store
제작 시작하기
ElevenLabs v3