Catégorie de voix

Générateur de voix pour YouTube

La plupart des outils de voix pour YouTube vous donnent un narrateur et s'arrêtent là. Cela marche pour une vidéo liste et s'effondre dès que votre script contient deux personnes. Distribuez le narrateur et les personnages dans le même projet, et exportez l'audio — avec un SRT synchrone à partir de Plus.

Quatre voix pour commencer

Les extraits sont provisoires, le temps que l'audio de démonstration publique soit produit. Toutes les voix sont disponibles dans toutes les formules : la bibliothèque n'est pas un mur payant.

La rétention est un problème d'écriture que la voix peut aider à résoudre

Tout, sur YouTube, découle de la rétention, et la rétention d'une vidéo narrée se décide dans les quinze premières secondes puis se redécide à chaque point où l'attention du spectateur s'égare. La voix compte ici d'une manière précise : un changement de voix est une relance d'attention, et elle est gratuite.

C'est pourquoi les chaînes qui mettent en scène leurs citations, qui utilisent une deuxième voix pour les apartés, ou qui basculent sur un personnage pendant trente secondes retiennent mieux que les chaînes à narrateur unique continu. Ce n'est pas que le narrateur soit mauvais. C'est que douze minutes ininterrompues d'une seule voix, quelle qu'elle soit, c'est beaucoup demander.

Écrire pour une lecture accélérée

Une part significative du public regarde à 1,25 fois la vitesse ou plus, et certains à double vitesse. Cela change la définition d'une bonne écriture. Les phrases longues deviennent inanalysables. Les incises disparaissent. Les chiffres et les noms propres ont besoin de plus d'espace autour d'eux, pas de moins.

Le test pratique consiste à auditionner votre narrateur sur votre vrai script en lecture accélérée. S'il survit à cela, il sera confortable en vitesse normale. Faire le test dans l'autre sens ne vous apprend rien sur la façon dont la majorité de votre public l'entendra.

Les sous-titres ne sont pas optionnels

Une grande partie du visionnage se fait sans le son ou dans un environnement bruyant, et les sous-titres améliorent de façon mesurable la rétention comme la portée. Les sous-titres automatiques valent mieux que rien et se trompent systématiquement sur les noms propres et les termes techniques, c'est-à-dire exactement le vocabulaire dont parle votre vidéo.

Comme le fichier de sous-titres (Plus et Pro) est ici généré depuis votre script plutôt que transcrit depuis l'audio, il est correct par construction. Déposez-le au lieu de compter sur le sous-titrage automatique, et vous corrigez les pires erreurs de sous-titres avant qu'elles existent.

Pour le français, l'enjeu est plus grand qu'en anglais : le sous-titrage automatique se trompe massivement sur les accords, les homophones et les noms propres, et un accord faux à l'écran pendant que la voix dit la bonne forme est exactement le genre de détail que les commentaires relèvent.

Le piège du volume

La tentation la plus forte, avec une chaîne de voix off peu coûteuse, est de produire plus de vidéos. C'est aussi le chemin le plus rapide vers une chaîne qui cesse d'être recommandée, parce que la plateforme est explicitement réglée contre les contenus produits en masse et peu différenciés.

Le meilleur usage du temps gagné, c'est plus d'écriture par vidéo : une deuxième voix, une séquence mise en scène, une ouverture réellement écrite. Ces trois choses étaient impossibles avec un outil à voix unique, et ces trois choses se lisent comme de l'effort pour un spectateur.

Écrire pour le deuxième écran

Une grande partie du visionnage long n'est pas du visionnage du tout : la vidéo tourne pendant que quelqu'un travaille, cuisine ou se déplace. Ce public entend tout et ne voit rien, ce qui fait de votre vidéo un produit audio avec des images accrochées dessus.

Deux conséquences. Ne dites jamais « comme vous pouvez le voir ici », parce qu'une partie notable de votre public ne le peut pas. Et mettez l'information dans la narration plutôt que dans le texte à l'écran, en vous servant du texte pour renforcer et non pour porter. Les chaînes qui font cela bien ont des rétentions inhabituellement hautes, précisément parce qu'elles ne perdent jamais l'auditeur qui a détourné les yeux.

La cohérence est l'identité de la chaîne

Les spectateurs reconnaissent une chaîne à sa voix plus vite qu'à ses miniatures. Cela fait du narrateur une décision de marque plutôt qu'une décision par vidéo, et cela veut dire que la pire chose à faire est de changer discrètement de voix d'une vidéo à l'autre parce qu'une plus récente sonnait mieux.

Choisissez-en une, notez son personnage de la bibliothèque et son caractère, reprenez exactement ce choix dans le projet de chaque vidéo et gardez-la, en écoutant la première réplique avant d'exporter, car un nouveau projet ne retombe pas forcément sur la même voix. Si vous devez vraiment changer, dites-le dans la vidéo : le public accepte un changement expliqué et se sent mal à l'aise devant un changement inexpliqué.

Du script à l'audio en quelques étapes

  1. Écrivez pour l'oreille, pas pour la page

    Des phrases courtes, une idée par phrase, pas de subordonnées. Un spectateur ne peut pas relire une phrase, donc tout ce qui demande une seconde lecture est perdu.

  2. Distribuez un narrateur écoutable en accéléré

    Une part importante des spectateurs regarde au-dessus du temps réel. Auditionnez votre narrateur accéléré, parce qu'une voix agréable en vitesse normale peut devenir incompréhensible à 1,5 fois.

  3. Donnez leur propre voix aux personnages

    Si votre script cite des gens, met en scène une conversation ou contient un sketch, distribuez ces rôles correctement. C'est l'amélioration de valeur de production la moins chère qui existe.

  4. Exportez le SRT avec l'audio

    Avec Plus et Pro. Les sous-titres améliorent la rétention et sont nécessaires à l'accessibilité. Les générer en même temps que l'audio signifie qu'ils sont déjà synchrones.

  5. Vérifiez le mixage contre votre nappe musicale

    Une voix parfaite en solo peut disparaître sous une nappe. Rendez, déposez dans votre montage, et écoutez avec la nappe au niveau où vous publiez réellement.

Questions fréquentes

La voix off IA est-elle autorisée sur YouTube ?

Oui. Les règles de YouTube visent les contenus produits en masse sans effort et les représentations synthétiques non déclarées de personnes réelles, pas la narration synthétique en elle-même. Une chaîne qui emploie des voix générées pour des scripts originaux n'est pas en infraction ; une chaîne qui génère automatiquement des centaines de vidéos quasi identiques l'est, quelle que soit la voix.

Est-ce que cela nuit à la monétisation ?

La politique de monétisation porte sur l'originalité et la valeur, pas sur la manière dont l'audio a été produit. Le risque, c'est de produire du contenu formaté en volume, qui est précisément ce que les examinateurs cherchent. Un script original lu par une voix synthétique n'est pas le cas problématique.

Dois-je le déclarer ?

YouTube exige une déclaration pour les représentations synthétiques réalistes de personnes et d'événements réels. Un narrateur généré pour votre propre script n'entre pas dans ce cadre, mais le dire dans la description ne coûte rien et construit la confiance.

Pourquoi ma voix off sonne-t-elle plate sous la musique ?

Presque toujours un problème de mixage et non de voix. Faites baisser la musique de plusieurs décibels sous le dialogue et creusez un peu d'espace dans le médium. Les deux sont des opérations en un clic dans n'importe quel logiciel de montage moderne.

Puis-je utiliser une seule voix sur toute une chaîne ?

Oui, et vous devriez : l'identité d'une chaîne est en grande partie une identité vocale. Les personnages ne passent pas d'un projet à l'autre : notez le personnage de la bibliothèque, le caractère et l'émotion par défaut du narrateur, reprenez-les pour chaque vidéo, et écoutez la première réplique avant d'exporter, car un nouveau projet ne retombe pas forcément sur la même voix.

Et les versions en langue étrangère ?

Le français est disponible avec vingt-trois voix distinctes par projet, dont treize francophones réparties entre la France, le Québec, la Belgique et la Suisse ; les dix autres sont des voix multilingues qui parlent français en langue seconde. Laquelle des deux familles revient à un personnage dépend de son âge et de son genre, pas de sa place dans la distribution : quinze des quarante personnages de la bibliothèque commencent sur une voix multilingue en français, donc une scène à deux peut en rencontrer une aussi bien qu'un grand ensemble. Les huit autres langues du site sont déjà ouvertes : une version dans une autre langue est un nouveau projet, créé depuis l'interface dans cette langue ; pour les publics que vous ne doublez pas, l'export de sous-titres (à partir de Plus) reste la voie pratique.

Distribuez votre première scène ce soir

Collez un script, laissez CastDub donner sa voix à chaque personnage, et exportez une fiction sonore finie.

Créer gratuitement

Sans carte bancaire. Free vous donne une réserve unique de crédits.