ElevenLabs Studiov3
Vozes realistas e música original, a partir de uma única caixa de texto
Escreva um roteiro e ouça-o lido por Eleven v3 ou Multilingual v2, ou descreva uma faixa e deixe a Eleven Music compô-la.
- Voz com Eleven v3 e Multilingual v2
- Faixas musicais de 5 segundos a 5 minutos
- Cada modelo também disponível via API REST
Ouça antes de escrever uma palavra
Gerações reais dos modelos desta página. Cada cartão mostra o roteiro ou prompt que a produziu.
Hey, take a deep breath. You’ve been doing great — even when it doesn’t feel like it. Sometimes, the smallest step forward is still progress.
Hello,welcome to WaveSpeedAI!
High-energy cyberpunk synthwave, driving analog bassline, retro futuristic synthesizers, punchy electronic drums, neon noir atmosphere, 120 BPM, mechanical textures.
I don’t need luck. I need focus. Every move, every second — it all leads to one goal.
Hello, little friend! I am your learning partner, Dr. Bot. Today, we will explore the amazing world of numbers together. Are you ready for a fun adventure? Let's go!
Modern deep house fashion runway music, stylish and elegant, groovy bass, rhythmic hi-hats, vocal chops, luxury brand advertisement vibe, confident and cool.
Meet the future of creativity — powered by AI, designed for humans. This is innovation that speaks in your voice.
Some things define eternity without a single word. They are not a product of time, but a witness to it. This is a classic, born for you—a perfect fusion of craftsmanship and art.
Steampunk ambient atmosphere, ticking clock sounds, mechanical gears clicking, steam hissing, soft acoustic guitar in the background, mysterious and studious.
In a world built on shadows and steel, only one voice can bring the story to life — yours.
Look at this! A golden, crispy crust wrapped around a tender, juicy center—the aroma is simply irresistible. Just one bite, and that rich flavor will melt on your tongue. This is absolutely the best dish I have ever tasted!
Once upon a time, in a forest painted with golden leaves, a little fox discovered that courage often comes wrapped in kindness.
Da primeira linha à trilha sonora finalizada, em um único estúdio
1. Dê voz a um roteiro com Eleven v3
Cole narração, diálogo ou um texto publicitário, escolha uma voz pelo nome e receba um arquivo de áudio pronto.
GerarWelcome to our advanced text-to-speech system! Experience high-quality voice synthesis with natural pronunciation and clear articulation.
2. Fale em mais idiomas com Multilingual v2
O modelo multilíngue lê roteiros além do inglês com as mesmas vozes e os mesmos controles.
GerarOh, brilliant. Another 'world-changing' idea, I'm sure. I can barely contain my excitement, really. So, I guess we're all just supposed to start working on this right now, right?
3. Musicalize o momento com Eleven Music
Descreva gênero, clima, instrumentos e andamento. Defina uma duração de até cinco minutos e mantenha instrumental, ou escreva a letra no prompt para ter vocais.
GerarHard Trap, Hip Hop, 808 bass, energetic flow, confident male rap vocals, brass stabs, hype music, motivational sports anthem. [Verse] Laced up tight, ready to go Putting on a major show Sweat and tears on the floor Coming back to get some more [Chorus] Eyes on the prize, reach for the net The greatest game you ever met I take the shot, I make the play Doing this every single day [Outro] Nothing but net. Yeah, we winning.
4. Molde a interpretação
Os controles de Stability e Similarity, mais o interruptor Speaker boost, mudam a forma como cada linha é lida, sem reescrever o roteiro.
5. Ou integre ao seu produto
Cada modelo tem seu próprio endpoint de API com as mesmas entradas que você vê aqui, então um roteiro do seu app vira áudio em uma única requisição.
Ver APIPOST /api/v3/elevenlabs/eleven-v3 { "text": "Every setback is fuel.", "voice_id": "Talia", "stability": 0.5 }
Modelos e preços
Os preços são por geração e atualizados em tempo real. Opções como resolução, duração ou qualidade podem alterar o preço final, que o gerador mostra antes de executar.
| Modelo | Entrada | A partir de | |
|---|---|---|---|
| Eleven v3 Text to Speech | Texto | $0.20 | Gerar |
| Eleven Multilingual v2 Text to Speech | Texto | $0.20 | Gerar |
| Eleven Music | Prompt | $0.10 | Gerar |
Perguntas frequentes
Com qual modelo de voz da ElevenLabs devo começar?
Comece com Eleven v3, o modelo de voz mais recente aqui. Mude para Multilingual v2 quando quiser comparar vozes em um roteiro em outro idioma; ambos usam o mesmo texto, a mesma voz e as mesmas configurações.
Como eu escolho uma voz?
Digite um nome de voz, como Talia, Darian ou Elowen, no campo Voice do gerador de áudio. Os mesmos nomes vão no campo voice_id ao chamar a API.
Para que servem Stability, Similarity e Speaker boost?
São configurações de voz da ElevenLabs. Stability e Similarity vão de 0 a 1 e mudam o quão consistente é a leitura e o quanto ela segue a voz escolhida; Speaker boost é um interruptor liga/desliga. Experimente alguns valores em uma linha para ouvir a diferença.
Quanto tempo pode durar uma faixa da Eleven Music?
Você define a duração no gerador, de 5 segundos até 5 minutos. As faixas são instrumentais por padrão; desative isso e coloque a letra no prompt quando quiser vocais.
Posso usar esses modelos a partir do meu próprio código?
Sim. Cada modelo da tabela tem uma página de API com um exemplo de requisição, e a documentação cobre autenticação e obtenção de resultados.