ElevenLabs Studiov3
Voces realistas y música original, desde un solo cuadro de texto
Escribe un guion y escúchalo leído por Eleven v3 o Multilingual v2, o describe una pista y deja que Eleven Music la componga.
- Voz con Eleven v3 y Multilingual v2
- Pistas musicales de 5 segundos a 5 minutos
- Cada modelo también disponible por API REST
Escucha antes de escribir una palabra
Generaciones reales de los modelos de esta página. Cada tarjeta muestra el guion o prompt que la produjo.
Hey, take a deep breath. You’ve been doing great — even when it doesn’t feel like it. Sometimes, the smallest step forward is still progress.
Hello,welcome to WaveSpeedAI!
High-energy cyberpunk synthwave, driving analog bassline, retro futuristic synthesizers, punchy electronic drums, neon noir atmosphere, 120 BPM, mechanical textures.
I don’t need luck. I need focus. Every move, every second — it all leads to one goal.
Hello, little friend! I am your learning partner, Dr. Bot. Today, we will explore the amazing world of numbers together. Are you ready for a fun adventure? Let's go!
Modern deep house fashion runway music, stylish and elegant, groovy bass, rhythmic hi-hats, vocal chops, luxury brand advertisement vibe, confident and cool.
Meet the future of creativity — powered by AI, designed for humans. This is innovation that speaks in your voice.
Some things define eternity without a single word. They are not a product of time, but a witness to it. This is a classic, born for you—a perfect fusion of craftsmanship and art.
Steampunk ambient atmosphere, ticking clock sounds, mechanical gears clicking, steam hissing, soft acoustic guitar in the background, mysterious and studious.
In a world built on shadows and steel, only one voice can bring the story to life — yours.
Look at this! A golden, crispy crust wrapped around a tender, juicy center—the aroma is simply irresistible. Just one bite, and that rich flavor will melt on your tongue. This is absolutely the best dish I have ever tasted!
Once upon a time, in a forest painted with golden leaves, a little fox discovered that courage often comes wrapped in kindness.
De la primera línea a la banda sonora terminada, en un solo estudio
1. Da voz a un guion con Eleven v3
Pega narración, diálogo o un guion publicitario, elige una voz por nombre y recibe un archivo de audio terminado.
GenerarWelcome to our advanced text-to-speech system! Experience high-quality voice synthesis with natural pronunciation and clear articulation.
2. Habla en más idiomas con Multilingual v2
El modelo multilingüe lee guiones más allá del inglés con las mismas voces y controles.
GenerarOh, brilliant. Another 'world-changing' idea, I'm sure. I can barely contain my excitement, really. So, I guess we're all just supposed to start working on this right now, right?
3. Musicaliza el momento con Eleven Music
Describe género, ambiente, instrumentos y tempo. Define una duración de hasta cinco minutos y mantenla instrumental, o escribe la letra en el prompt para tener voces.
GenerarHard Trap, Hip Hop, 808 bass, energetic flow, confident male rap vocals, brass stabs, hype music, motivational sports anthem. [Verse] Laced up tight, ready to go Putting on a major show Sweat and tears on the floor Coming back to get some more [Chorus] Eyes on the prize, reach for the net The greatest game you ever met I take the shot, I make the play Doing this every single day [Outro] Nothing but net. Yeah, we winning.
4. Da forma a la interpretación
Los controles de Stability y Similarity, más el interruptor de Speaker Boost, cambian cómo se lee cada línea, sin reescribir el guion.
5. O intégralo en tu producto
Cada modelo tiene su propio endpoint de API con las mismas entradas que ves aquí, así que un guion de tu app se convierte en audio en una sola solicitud.
Ver APIPOST /api/v3/elevenlabs/eleven-v3 { "text": "Every setback is fuel.", "voice_id": "Talia", "stability": 0.5 }
Modelos y precios
Los precios son por generación y se actualizan en tiempo real. Opciones como la resolución, la duración o la calidad pueden cambiar el precio final, que el generador muestra antes de ejecutar.
| Modelo | Entrada | Desde | |
|---|---|---|---|
| Eleven v3 Text to Speech | Texto | $0.20 | Generar |
| Eleven Multilingual v2 Text to Speech | Texto | $0.20 | Generar |
| Eleven Music | Prompt | $0.10 | Generar |
Preguntas frecuentes
¿Con qué modelo de voz de ElevenLabs debería empezar?
Empieza con Eleven v3, el modelo de voz más nuevo aquí. Cambia a Multilingual v2 cuando quieras comparar voces en un guion en otro idioma; ambos usan el mismo texto, voz y configuración.
¿Cómo elijo una voz?
Escribe un nombre de voz, como Talia, Darian o Elowen, en el campo Voice del generador de audio. Los mismos nombres van en el campo voice_id al llamar a la API.
¿Qué hacen Stability, Similarity y Speaker boost?
Son ajustes de voz de ElevenLabs. Stability y Similarity van de 0 a 1 y cambian cuán constante es la lectura y cuán fiel es a la voz elegida; Speaker boost es un interruptor de encendido/apagado. Prueba varios valores en una línea para oír la diferencia.
¿Cuánto puede durar una pista de Eleven Music?
Defines la duración en el generador, de 5 segundos hasta 5 minutos. Las pistas son instrumentales por defecto; desactívalo y pon la letra en el prompt cuando quieras voces.
¿Puedo usar estos modelos desde mi propio código?
Sí. Cada modelo de la tabla tiene una página de API con un ejemplo de solicitud, y la documentación cubre la autenticación y la obtención de resultados.