Categoria de voz

Faça a locução do seu vídeo e a legenda junto

Quase toda ferramenta de voz para YouTube te dá um narrador e considera o assunto encerrado. Isso serve para vídeo de lista e desmonta no instante em que o seu roteiro tem duas pessoas dentro. Escale narrador e personagens no mesmo projeto e exporte o áudio — com um SRT sincronizado a partir do Plus.

Quatro vozes para começar

Quill

Quill

Voz de explicação que nunca soa entediada

clarosimpático
Hale

Hale

Peso documental para vídeo longo

calmodocumentário
Indie

Indie

Rápido, chapado, vagamente debochado

informalrápido

As amostras são provisórias enquanto o áudio de demonstração público é produzido. Toda voz está disponível em todos os planos — a biblioteca não é paywall.

Retenção é problema de texto que a voz ajuda a resolver

Tudo em desempenho no YouTube deriva de retenção, e a retenção de um vídeo narrado é decidida nos primeiros quinze segundos e redecidida a cada corte. Nada disso é sobre qualidade de voz: é sobre quanto tempo o público consegue ficar sem que aconteça alguma coisa nova.

É por isso que canais que dramatizam citações, usam uma segunda voz para comentários laterais ou cortam para um personagem por trinta segundos seguram mais gente do que canais com narração contínua. A troca de voz é um evento, e evento é o que compra mais quinze segundos.

Escrever para reprodução acelerada

Uma parcela relevante do público assiste em 1,25x ou mais rápido, e alguns em 2x. Isso muda o que é boa escrita. Frase longa fica impossível de processar. Nome que só aparece uma vez se perde. E o português sofre mais do que o inglês nessa conta, porque a nossa frase já é naturalmente mais longa e mais cheia de sílaba átona — o que em inglês seria uma linha confortável, em português vira duas.

O teste prático é ouvir o seu narrador no seu roteiro real em 1,5x. Se sobreviver ali, fica confortável em 1x. Fazer o teste na ordem inversa não informa nada.

Legenda não é opcional

Uma fração grande da audiência assiste sem som ou em ambiente barulhento, e legenda melhora mensuravelmente retenção e alcance. Legenda automática não resolve: ela erra nome próprio, erra gíria e erra termo técnico exatamente nas palavras que mais importam para o seu vídeo ser encontrado.

Como aqui a legenda (no Plus e no Pro) é gerada a partir do seu roteiro e não transcrita do áudio, ela é correta por construção. Suba o seu arquivo em vez de aceitar o automático, e de quebra você ganha o texto certo para o algoritmo ler.

A armadilha do volume

A tentação mais forte de quem monta um fluxo barato de locução é produzir mais vídeos. É também o caminho mais rápido para um canal parar de ser recomendado, porque a plataforma mede o que o público faz com o vídeo e não quantos você publicou.

O uso melhor do tempo economizado é mais roteiro por vídeo: uma segunda voz, um trecho dramatizado, uma abertura escrita direito. As três coisas eram inviáveis quando cada voz extra custava uma sessão de gravação, e são justamente as três que aumentam retenção.

Roteiro para a segunda tela

Boa parte do consumo de vídeo longo não é assistir — o vídeo toca enquanto a pessoa trabalha, cozinha ou vai para o trabalho. Esse público ouve tudo e não vê nada, o que transforma o seu vídeo num produto de áudio com imagem anexada.

Duas consequências. Nunca diga “como vocês estão vendo aqui”, porque uma parte relevante do seu público não está vendo. E ponha a informação na narração em vez de no texto na tela, usando o texto para reforçar e não para carregar. Canais que fazem isso bem costumam ter retenção incomumente alta, e o motivo é que eles nunca perdem quem desviou o olhar.

Constância é identidade de canal

O público reconhece um canal pela voz antes de reconhecer pela miniatura. Isso faz do narrador uma decisão de marca e não uma decisão por vídeo, e significa que a pior coisa que dá para fazer é trocar de voz caladamente entre vídeos porque uma nova soou melhor.

Escolha uma, anote o personagem da biblioteca e o perfil, escolha exatamente os mesmos no projeto de cada vídeo e mantenha — ouvindo a primeira fala antes de exportar, já que um projeto novo não tem garantia da mesma voz. Se você realmente precisar mudar, diga no vídeo — público aceita mudança explicada e fica desconfortável com mudança não explicada.

Do roteiro ao áudio em poucos passos

  1. Escreva para o ouvido

    Frase curta, uma ideia por vez, sem oração subordinada. Quem assiste não relê, então qualquer coisa que exija segunda passada está perdida.

  2. Teste o narrador acelerado

    Uma parcela grande do público assiste acima da velocidade real. Ouça o seu narrador acelerado, porque voz agradável em 1x vira ininteligível em 1,5x.

  3. Escale os personagens

    Se o roteiro cita alguém, dramatiza uma conversa ou tem esquete, escale essas partes direito. É a melhoria de produção mais barata que existe.

  4. Exporte o SRT junto

    No Plus e no Pro. Legenda melhora retenção e é exigência de acessibilidade. Gerar junto com o áudio significa que ela já nasce sincronizada.

  5. Confira com a trilha

    Voz que fica perfeita sozinha pode sumir embaixo da cama de música. Renderize, jogue no editor e ouça com a trilha no nível em que você realmente publica.

Perguntas frequentes

Locução com IA é permitida no YouTube?

É. As políticas do YouTube miram conteúdo produzido em massa com pouco esforço e mídia sintética não declarada de pessoas reais, não narração sintética em si. Canal que usa voz gerada para roteiro original próprio não está em violação; canal que gera automaticamente centenas de vídeos quase idênticos está, independentemente da voz.

Isso atrapalha a monetização?

A política de monetização gira em torno de originalidade e valor, não de como o áudio foi produzido. O risco é produzir conteúdo formulaico em volume, que é o que os revisores procuram. Roteiro original lido por voz sintética não é o caso problemático.

Preciso declarar?

O YouTube exige declaração para representações sintéticas realistas de pessoas e eventos reais. Um narrador gerado para o seu próprio roteiro não cai nessa regra, mas dizer na descrição não custa nada e constrói confiança.

Por que a minha locução some embaixo da música?

Quase sempre é mixagem, não é voz. Abaixe a música alguns decibéis sob a fala e abra um pouco de espaço na região média. As duas coisas são um clique em qualquer editor moderno.

Posso usar uma voz só no canal inteiro?

Pode, e deve — identidade de canal é em boa medida identidade de voz. Personagens não passam de um projeto para outro, então anote o personagem da biblioteca, o perfil e a emoção padrão do narrador, escolha tudo de novo em cada vídeo e ouça a primeira fala antes de exportar, já que um projeto novo não tem garantia da mesma voz.

E versões em outros idiomas?

A CastDub trabalha nos nove idiomas do site, e os mesmos quarenta personagens atuam em todos eles. Em português, um projeto chega a dezesseis vozes distintas, das quais cinco são nativas (pt-BR e pt-PT) e onze são vozes multilíngues de outra língua materna — qual das duas famílias cabe a um personagem depende da idade e do gênero dele, não do lugar dele no elenco: vinte e cinco dos quarenta personagens da biblioteca já começam numa voz multilíngue em português, então uma cena de duas pessoas chega nelas tanto quanto um elenco grande. Para alcançar público de outro idioma sem refazer a locução, a exportação de legenda, a partir do Plus, continua sendo o caminho prático.

Escale a sua primeira cena hoje à noite

Cole um roteiro, deixe a CastDub dar uma voz a cada personagem e exporte um audiodrama pronto.

Criar de graça

Sem cartão de crédito. O Free dá um bolo único de créditos.