音色分类

青少年音色生成器

青少年角色撑起了大半的青春小说、动漫和校园题材,同时也最容易配错——配得太小像卡通,配得太大整个前提就塌了。这些音色落在真正听起来十五到十九岁的那条带子上。

先从这四把音色开始

Cass

Cass

十七岁,正在生气,而且气得有理

少年凌厉

公开试听音频还在制作中,样音暂为占位。所有套餐都能用到全部音色——音色库不是付费墙。

没人配对过的那个年龄段

青春期的声音在生理上和儿童、成年都不一样——音域已经定了,共鸣还没定,而语速和断句都比相邻两个年龄段更快更短。文字转语音的音色库历来整段跳过这一带,只给儿童音色和成年音色,中间什么都没有,所以业余做的青春题材音频里,十几岁的角色总是听起来三十岁。

从真正的青少年音色带里挑人,很多写作上的问题会自己消失。用成年音色读着别扭的台词,换到十七岁的节奏里往往读得非常自然——因为它本来就是照那个节奏写的。

态度是选角决定,不是参数设置

青春小说靠姿态运转:用玩笑挡回去的那个、一句不说的那个、真诚到让人尴尬的那个。在文字里他们是不同的人,因为你能看到他们的选词。在音频里,只有当各自的音色带着不同的默认能量时,他们才是不同的人。

每个角色的静息情绪设一次,然后逐句去导那些例外。多数青春题材场景的情绪曲线,是一长段中性加上打破它的两句话,而精确标出这两句,比把整场戏往戏剧化那边推有效得多。

常见用法

占主导的三种是:动漫和漫画同人音频、在画手写手社群里流传的原创角色小剧场,以及竖屏短剧——校园题材在全球都是产量最高的品类之一。三者都产得快、量大,通常是一个人做,而且都受益于改本之后直接重渲一场戏,而不是再约一次录音。

视觉小说是第四种,情况略有不同:那里的青少年音色要承担几百条短的分支台词,而不是连续的场景,所以角色卡比导戏更重要——玩家真正会注意的是跨分支的一致性。

关于真实感的说明

合成的青少年音色在对话里很可信,在极端处就没那么可信。隔着房间喊、说到一半哭出来、边笑边讲——这些都是身体事件,模型只是在逼近,而不是复现。能绕的地方绕开这些极端;绕不开的地方,可以考虑那几句自己录了再剪进去。

这不是永久的限制,但它是当下的限制,提前绕着它规划,总好过在最后一版成片里被它吓一跳。

几步就能把剧本变成音频

  1. 先定年龄段,再挑音色

    十五岁和十九岁是两种乐器。先决定你的角色站在青春期的哪一头,然后只试听那一段里的音色。

  2. 把所有说话人一起贴进来

    青少年的戏基本都是群戏——朋友、对手,还有一个不理解他们的大人。一起配,第一遍渲染就能看出整个阵容的平衡。

  3. 设好默认态度

    多数青少年角色有一个静息状态:无聊、跃跃欲试、戒备。把它设成这个角色的默认情绪,你就只需要导那些例外的句子。

  4. 导那几个转折

    青春题材活在盔甲卸下来的那一瞬间。把那几句具体的台词标成难过或耳语,周围全部留在中性——对比会替你干活。

  5. 导出后用手机听一遍

    你的听众是用手机喇叭或便宜耳机听的。发布前先在那种设备上检查,高而亮的音色在小单元上表现完全不同。

常见问题

会不会像成年人装年轻?

库里的青少年音色是独立训练的模型,不是把成年音色调高,而后者正是那种「装」的通常原因。剩下的破功点在句法:如果你写又长又正式的句子,任何音色听起来都会比你想的老。

能用俚语和网络缩写吗?

俚语当普通词写就行,念出来是自然的。缩写风险大一些——有的会被当成一个词念,有的会被逐字母拼出来,取决于具体是哪个。检查一次,需要的地方加上发音修正。

其它语言的校园题材呢?

今天完整的音色库是英语。接下来会依次增加日语、西班牙语、巴西葡萄牙语和韩语,因为有声剧和同人创作的受众主要在那几处。

青少年音色能撑完一整本有声书吗?

第一人称的青春小说可以,而且是常见选择——叙述者就是主角,用青少年音色才是对的。只是要多留一些剪辑时间:明亮的音色撑一小时,比温厚的中音旁白更不宽容。

怎么让两个青少年角色能分清?

靠语速和态度分,别靠音高分。两个能量一样的音色,音高拉得再远也会糊;而一个又快又急、一个又慢又戒备,就算音色接近也分得开。

有什么是不该写的?

不要写涉及被设定为未成年人的角色的性化内容——无论音频怎么做出来,这都违反我们的条款,生成这类内容的账号会被关闭。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。