Audio Tags inline como notas de dirección
Escribe [whispers], [excited], [laughs], [sighs], [sarcastically] en el texto. Para narración y locuciones con emoción concreta, menos «generar otra vez y cruzar los dedos».
TTS GA de ElevenLabs más expresivo: Audio Tags inline, diálogo multivoz, más de 70 idiomas; 4,9 % de error. Predeterminado para narración, diálogo y locuciones con interpretación.

GA vs Alpha: 72 % de preferencia de usuarios; tasa de error en dígitos, símbolos y notación del 15,3 % al 4,9 % — menos retomas cuando la locución lee mal importes y fechas.

Audio Tags inline para emoción, diálogo multivoz, más de 70 idiomas en un flujo — si la narración suena plana, los personajes se pisan o los acentos cambian entre idiomas, ajusta etiquetas y voces antes de regenerar a ciegas.
Escribe [whispers], [excited], [laughs], [sighs], [sarcastically] en el texto. Para narración y locuciones con emoción concreta, menos «generar otra vez y cruzar los dedos».
Text to Dialogue gestiona turnos de varios personajes, interrupciones y transiciones emocionales. Podcasts, cinemáticas de juegos, demos de historias — menos «una voz hace dos papeles».
Contenido global sin cambiar de modelo por locale. VO localizado y anuncios multilingües: alinea specs, luego edita texto y etiquetas — no reabrir toda la pipeline.
Narración, diálogo y locuciones — distintos entregables, mismo coste de fallo: regrabaciones y plazos incumplidos.
Usa etiquetas para respiración y arco emocional cuando haga falta. Lectura plana o clímax débil rompe la inmersión; ElevenLabs v3 es el predeterminado para expresividad narrativa.
Contexto compartido multivoz. Personajes que se pisan o emoción incorrecta arruinan cinemáticas; el modo diálogo supera coser TTS monovoz.
Nombra emoción, contención e ironía con etiquetas. Tono de lectura erróneo implica regrabar todo el spot; define etiquetas primero, escucha, menos muestreo a ciegas.
Ve a Audio y selecciona ElevenLabs v3.
Texto + etiquetas en inglés minúsculas entre corchetes, p. ej. [whispers] Something's coming… [sighs]. Multipersonaje: usa el flujo de diálogo para separar voces.
Escucha emoción y dicción primero; si falla, cambia etiquetas/redacción y regenera — no reescribas todo el guion a ciegas.
Antes de empezar: créditos gratis, nombre del modelo, sintaxis de etiquetas, cuándo usarlo por defecto.
Audio Tags · multivoz · más de 70 idiomas — junto a modelos de imagen/video, abre y empieza.
Usar ElevenLabs v3 gratisNo se requiere clave API de ElevenLabs.