
Quill
Voz de explicação que nunca soa entediada
Categoria de voz
Quase toda ferramenta de voz para YouTube te dá um narrador e considera o assunto encerrado. Isso serve para vídeo de lista e desmonta no instante em que o seu roteiro tem duas pessoas dentro. Escale narrador e personagens no mesmo projeto e exporte o áudio — com um SRT sincronizado a partir do Plus.

Quill
Voz de explicação que nunca soa entediada

Hale
Peso documental para vídeo longo

Indie
Rápido, chapado, vagamente debochado

Duke
Para os trinta segundos dramáticos
As amostras são provisórias enquanto o áudio de demonstração público é produzido. Toda voz está disponível em todos os planos — a biblioteca não é paywall.
Tudo em desempenho no YouTube deriva de retenção, e a retenção de um vídeo narrado é decidida nos primeiros quinze segundos e redecidida a cada corte. Nada disso é sobre qualidade de voz: é sobre quanto tempo o público consegue ficar sem que aconteça alguma coisa nova.
É por isso que canais que dramatizam citações, usam uma segunda voz para comentários laterais ou cortam para um personagem por trinta segundos seguram mais gente do que canais com narração contínua. A troca de voz é um evento, e evento é o que compra mais quinze segundos.
Uma parcela relevante do público assiste em 1,25x ou mais rápido, e alguns em 2x. Isso muda o que é boa escrita. Frase longa fica impossível de processar. Nome que só aparece uma vez se perde. E o português sofre mais do que o inglês nessa conta, porque a nossa frase já é naturalmente mais longa e mais cheia de sílaba átona — o que em inglês seria uma linha confortável, em português vira duas.
O teste prático é ouvir o seu narrador no seu roteiro real em 1,5x. Se sobreviver ali, fica confortável em 1x. Fazer o teste na ordem inversa não informa nada.
Uma fração grande da audiência assiste sem som ou em ambiente barulhento, e legenda melhora mensuravelmente retenção e alcance. Legenda automática não resolve: ela erra nome próprio, erra gíria e erra termo técnico exatamente nas palavras que mais importam para o seu vídeo ser encontrado.
Como aqui a legenda (no Plus e no Pro) é gerada a partir do seu roteiro e não transcrita do áudio, ela é correta por construção. Suba o seu arquivo em vez de aceitar o automático, e de quebra você ganha o texto certo para o algoritmo ler.
A tentação mais forte de quem monta um fluxo barato de locução é produzir mais vídeos. É também o caminho mais rápido para um canal parar de ser recomendado, porque a plataforma mede o que o público faz com o vídeo e não quantos você publicou.
O uso melhor do tempo economizado é mais roteiro por vídeo: uma segunda voz, um trecho dramatizado, uma abertura escrita direito. As três coisas eram inviáveis quando cada voz extra custava uma sessão de gravação, e são justamente as três que aumentam retenção.
Boa parte do consumo de vídeo longo não é assistir — o vídeo toca enquanto a pessoa trabalha, cozinha ou vai para o trabalho. Esse público ouve tudo e não vê nada, o que transforma o seu vídeo num produto de áudio com imagem anexada.
Duas consequências. Nunca diga “como vocês estão vendo aqui”, porque uma parte relevante do seu público não está vendo. E ponha a informação na narração em vez de no texto na tela, usando o texto para reforçar e não para carregar. Canais que fazem isso bem costumam ter retenção incomumente alta, e o motivo é que eles nunca perdem quem desviou o olhar.
O público reconhece um canal pela voz antes de reconhecer pela miniatura. Isso faz do narrador uma decisão de marca e não uma decisão por vídeo, e significa que a pior coisa que dá para fazer é trocar de voz caladamente entre vídeos porque uma nova soou melhor.
Escolha uma, anote o personagem da biblioteca e o perfil, escolha exatamente os mesmos no projeto de cada vídeo e mantenha — ouvindo a primeira fala antes de exportar, já que um projeto novo não tem garantia da mesma voz. Se você realmente precisar mudar, diga no vídeo — público aceita mudança explicada e fica desconfortável com mudança não explicada.
Frase curta, uma ideia por vez, sem oração subordinada. Quem assiste não relê, então qualquer coisa que exija segunda passada está perdida.
Uma parcela grande do público assiste acima da velocidade real. Ouça o seu narrador acelerado, porque voz agradável em 1x vira ininteligível em 1,5x.
Se o roteiro cita alguém, dramatiza uma conversa ou tem esquete, escale essas partes direito. É a melhoria de produção mais barata que existe.
No Plus e no Pro. Legenda melhora retenção e é exigência de acessibilidade. Gerar junto com o áudio significa que ela já nasce sincronizada.
Voz que fica perfeita sozinha pode sumir embaixo da cama de música. Renderize, jogue no editor e ouça com a trilha no nível em que você realmente publica.
É. As políticas do YouTube miram conteúdo produzido em massa com pouco esforço e mídia sintética não declarada de pessoas reais, não narração sintética em si. Canal que usa voz gerada para roteiro original próprio não está em violação; canal que gera automaticamente centenas de vídeos quase idênticos está, independentemente da voz.
A política de monetização gira em torno de originalidade e valor, não de como o áudio foi produzido. O risco é produzir conteúdo formulaico em volume, que é o que os revisores procuram. Roteiro original lido por voz sintética não é o caso problemático.
O YouTube exige declaração para representações sintéticas realistas de pessoas e eventos reais. Um narrador gerado para o seu próprio roteiro não cai nessa regra, mas dizer na descrição não custa nada e constrói confiança.
Quase sempre é mixagem, não é voz. Abaixe a música alguns decibéis sob a fala e abra um pouco de espaço na região média. As duas coisas são um clique em qualquer editor moderno.
Pode, e deve — identidade de canal é em boa medida identidade de voz. Personagens não passam de um projeto para outro, então anote o personagem da biblioteca, o perfil e a emoção padrão do narrador, escolha tudo de novo em cada vídeo e ouça a primeira fala antes de exportar, já que um projeto novo não tem garantia da mesma voz.
A CastDub trabalha nos nove idiomas do site, e os mesmos quarenta personagens atuam em todos eles. Em português, um projeto chega a dezesseis vozes distintas, das quais cinco são nativas (pt-BR e pt-PT) e onze são vozes multilíngues de outra língua materna — qual das duas famílias cabe a um personagem depende da idade e do gênero dele, não do lugar dele no elenco: vinte e cinco dos quarenta personagens da biblioteca já começam numa voz multilíngue em português, então uma cena de duas pessoas chega nelas tanto quanto um elenco grande. Para alcançar público de outro idioma sem refazer a locução, a exportação de legenda, a partir do Plus, continua sendo o caminho prático.
Cole um roteiro, deixe a CastDub dar uma voz a cada personagem e exporte um audiodrama pronto.
Criar de graçaSem cartão de crédito. O Free dá um bolo único de créditos.