ElevenLabs v3
Thẻ âm thanh
Giọng nói do bạn điều khiển
Với [laughs], [whispers], [excited], bạn có thể chèn chỉ dẫn ngay trong văn bản. v3 hiểu mỗi chỉ dẫn như một yêu cầu diễn xuất. Tạo cảnh nhiều người nói chỉ với một lần gọi API. Hỗ trợ 70+ ngôn ngữ. Xuất WAV hoặc MP3 rồi thả các nút âm thanh vào quy trình video trên Zeemo.
Đạo diễn âm thanh như một nhà làm phim
Một mẫu, bốn khả năng. Kiểm soát cảm xúc nội tuyến thông qua thẻ âm thanh. Cảnh nhiều người nói từ một kịch bản duy nhất. Ngữ điệu bản địa trên các hơn 70 ngôn ngữ. Tỷ lệ lỗi 4.9% trên mọi thế hệ.
Viết [laughs] và nghe tiếng cười sống động
Viết cách bạn muốn mỗi dòng được phân phối, ngay trong tập lệnh. [cười], [thì thầm], [chậm], [phấn khích] - thả họ theo hướng giống như trên sân khấu và người mẫu sẽ làm theo. Không có danh sách thả xuống cài sẵn. Không có trình chỉnh sửa dạng sóng.
Tập lệnh của bạn gọi các cảnh quay.
Chỉ đạo cảnh đầu tiên của bạnDán kịch bản, có ngay cả dàn diễn viên
Dán tập lệnh có tên nhân vật. Lấy lại cảnh hội thoại đầy đủ trong đó mọi giọng nói đều nhất quán từ dòng đầu tiên đến dòng cuối cùng, cho đến các ký tự 5,000. Không có đường khâu nào đi cùng nhau. Không bị trôi giọng trong các cảnh dài.
Toàn bộ diễn viên. Một cú nhấp chuột. Mọi giọng nói đều giữ nguyên ký tự.
Truyền cảnh đối thoại của bạnNói 70+ ngôn ngữ như người bản xứ
Speak 70+, mỗi ngôn ngữ có nhịp điệu và ngữ điệu bản địa. Tiếng Nhật nghe có vẻ giống tiếng Nhật chứ không phải tiếng Anh có giọng. Tiếng Hindi mang lại sự căng thẳng phù hợp. thẻ âm thanh hoạt động ở mọi ngôn ngữ.
Hiệu suất thực sự. Mọi ngôn ngữ.
Tạo bằng hơn 70 ngôn ngữViết cả cuốn sách, nhận mộtệp âm thanh duy nhất
Tạo tối đa 5,000 ký tự trong một lần. Sách nói, tập podcast, thuyết minh đào tạo — viết toàn bộ kịch bản, nhận mộtệp liên tục. Giọng nói vẫn ổn định từ đầu đến cuối. Không nối. Không có đường nối.
Mộtệp. Không có đường nối. Viết dài.
Tạo âm thanh dạng dàiNghe những gì bạn có thể tạo
Sách nói, podcast, hội thoại trò chơi, thuyết minh video. Một mô hình đáp ứng mọi dự án giọng nói.
Cách dùng ElevenLabs v3 trên Zeemo
Chế độ chọn & mẫu
Mở Canvas vô hạn Zeemo. Chọn ElevenLabs v3. TTS cho một giọng nói. Đối thoại cho cảnh nhiều loa.
Tag & Generator
Dán văn bản. Thả [cười], [thì thầm], [phấn khích] nơi giao hàng. Mỗi thẻ điều khiển các từ ~4–5. Không cần phỏng đoán.
Nghe và xuất
Tạo. Nghe ngay trên canvas. Tinh chỉnh một thẻ, tái tạo. Xuất WAV/MP3. Thả nút âm thanh vào bất kỳ đường dẫn video nào — cùng một canvas.

