
Noor
Newsreader clarity for exposition-heavy scenes
Síntesis
El texto a voz corriente convierte un bloque de texto con una sola voz. Es la herramienta correcta para narrar y la equivocada para una escena. Esta página trata de la capa de síntesis en sí: qué se le puede pedir y dónde se detiene.

Noor
Newsreader clarity for exposition-heavy scenes

Quill
YouTube explainer voice that never sounds bored

Dorian
Audiobook baritone for literary fiction and slow reveals

Solène
Continental accent, unhurried, very expensive sounding

Halcyon
Meditation-adjacent narrator for slow, quiet scenes

Indie
TikTok voiceover: fast, flat, faintly amused

Wren
Bedtime-story narrator, slow and warm, never wakes anyone up

Hale
Documentary narrator with a hand on the listener's shoulder
Neutral, alegría, tristeza, ira, miedo, susurro y entusiasmo, fijados por línea y no por documento. Con el motor de hoy, cualquier registro se puede poner en cualquier voz, y se consigue variando velocidad, tono y volumen, no con un modelo de emoción de verdad: las etiquetas de la biblioteca dicen para qué registros está pensado un personaje, no cuáles se van a renderizar.
Un multiplicador de velocidad por línea, en Plus y Pro. El ritmo trabaja más de lo que la gente supone: transmite edad, autoridad y estado emocional con más fiabilidad que el tono.
Una línea escrita entera entre paréntesis se toma como una indicación para quien interpreta y no se lee en voz alta. Los encabezados de escena y las descripciones de acción son otra cosa: salen como narración, así que borra los que no quieras que se oigan.
Un punto es una pausa real, los puntos suspensivos una más larga, y un signo de interrogación levanta el final de la frase. Los saltos de línea abren huecos. La disposición de tu guion es tu control de tiempos, y por eso esta página no deja de pedirte que separes las líneas.
El motor de síntesis está detrás de una interfaz. Hoy renderiza un motor provisional mientras se conecta el motor de producción; el mismo proyecto se va a renderizar con otro motor sin que cambie nada de tu reparto ni de tu dirección.
La biblioteca no es el muro de pago. Los planes se diferencian en tamaño del reparto, control de emoción y minutos, no en qué voces puedes usar.
Una sola voz o muchas. Con una sola voz, esto se comporta como cualquier otra herramienta de texto a voz.
Elige entre los cuarenta personajes de la biblioteca: filtra por edad, género, acento y estilo en lugar de ir bajando por la lista. Haz la audición con tu propio texto, no con el de ejemplo.
Empieza en neutral y, en Plus o Pro, un poco más lento de lo que te parece correcto. Casi todos los primeros intentos van demasiado rápido.
Haz la audición de todos los nombres y las palabras inventadas antes de renderizar nada largo, y a los que salgan mal cámbiales la grafía o sepáralos con guiones en el propio texto: no hay ningún ajuste de pronunciación.
Ponlo en el altavoz del teléfono además de en auriculares. La mayoría del público escucha ahí y no en un buen equipo.
El instinto, cuando tienes emoción por línea, es usarla en todas partes, y el resultado es una papilla uniforme. El público lee la emoción por contraste, así que una escena con dos líneas dirigidas y veinte neutrales golpea mucho más fuerte que una donde todo está forzado.
El flujo que da buenos resultados es este: fija un registro de base por personaje, renderiza solo con los valores por defecto, escucha de corrido y después marca las dos o tres líneas donde algo cambia de verdad. En una escena de cinco minutos, dirigir cinco líneas a mano está más o menos bien.
Cuatro costumbres se llevan casi toda la diferencia. Una intención por línea: una frase que pasa del gozo al horror se interpreta como el promedio de ambos, así que sepárala. Puntúa a propósito, porque la puntuación son tus tiempos. Las interjecciones, en su propia línea, porque el motor lee texto y no acotaciones. Y frases cortas para las voces graves, que pierden inteligibilidad rápido en las subordinadas largas.
Nada de esto es un truco para esquivar una limitación. Son las mismas indicaciones que alguien que dirige le da a una persona que interpreta, por los mismos motivos.
La vocalización física —gritar, llorar, reírse mientras se habla, gruñir— es la parte más floja y va a seguir siéndolo un tiempo, porque son eventos de respiración y no de habla. Genérala como material provisional si la necesitas, y cuenta con reemplazarla.
El segundo límite es la interpretación. Una lectura sintética es una versión limpia, constante y bien medida de lo que escribiste. No es una serie de decisiones sobre el subtexto. Para la mayoría del trabajo, ese intercambio vale la pena; vale la pena hacerlo con los ojos abiertos sobre cuál mitad es cuál.
Con una sola voz, en poco. La diferencia aparece en el momento en que un guion tiene más de una persona hablando: el reparto, una voz que se mantiene fija para cada personaje dentro de un proyecto y la dirección por línea son el producto, y la síntesis es una pieza por debajo.
Neutral, alegría, tristeza, ira, miedo, susurro y entusiasmo, en todas las voces. Con el motor provisional de hoy son aproximaciones hechas con velocidad, tono y volumen, no interpretaciones actuadas, así que escucha una línea dirigida antes de confiar en ella.
No. El ritmo, sí, en Plus y Pro; el tono, no. Llevar una voz muy lejos de su rango natural produce artefactos que se notan en unos auriculares buenos. Elige en su lugar un personaje que ya esté en el rango correcto.
Aplica las convenciones de la región de la voz, así que una voz estadounidense lee las fechas a la manera estadounidense. Los errores aparecen en textos que mezclan convenciones; si el tuyo las mezcla, revisa primero los números.
Uno provisional, mientras se conecta el motor de producción. Por eso la voz de un personaje de la biblioteca es una aproximación a su perfil y la emoción se consigue con velocidad y tono. Gracias a la interfaz de proveedor, el cambio no va a exigir tocar tu reparto ni tu dirección.
Sí, aunque para accesibilidad conviene la voz más clara y no la más característica, y hay que probarla a 1,5× o más rápido, porque mucha gente que usa lectores de pantalla escucha muy por encima de la velocidad normal.
Pega un guion, deja que CastDub le dé una voz propia a cada personaje y exporta un audiodrama terminado.
Empieza gratisSin tarjeta. Free te da una bolsa única de créditos.