
Brix
由热情和坏主意组成的小跟班
传统动画公司给一部卡通挑配音阵容,思路和作曲家配器一样:他们要的是各个声部能分得开。任何长寿动画里你都能听出来——角色各自占着不同的音高带、不同的语速、气息量也不同。这里没有一处需要贵的声音,需要的只是刻意拉开距离。
自制卡通的声音听起来「糊」,原因几乎总是所有角色都从同一条又窄又好听的中性音色带里挑出来的。解法一开始会让你不太舒服:挑一个偏高的、一个偏低的、一个说话太快的。单独放会觉得夸张,放进一场戏里就成了角色。
三个习惯差别很大。第一,一句话只承担一个意图——一句从惊喜荡到惊恐的台词,渲染出来会是两者的平均值,请拆开。第二,标点就是导演指令:句号是一次真实的停顿,省略号停得更久,问号会把句尾挑起来。第三,把语气词写出来。单独一行的「唉。」会得到一次表演,「(叹气)」什么都得不到,因为渲染器念的是文字,不是舞台提示。
第四个习惯没那么明显。卡通本子里满是人名、造词和拟声词,而这些恰恰是文字转语音最容易猜错的东西。先把造词过一遍,发音改对一次,整个项目里就一直是对的。
单干的人多半先做音频再做画面,因为对着锁定的声音做动画,比反过来容易太多。这套流程很适合这个工具:先把表演调对,导出分轨,再对着不会再变的音频做口型。
如果你的流程是反过来的、画面已经有了,就用字幕导出把台词摆到时间轴上,再逐句调语速去填空隙。这活儿挺琐碎,但还是比重新请人录快。
它不会模仿某个具体的商业卡通配音员,我们也不会为此建克隆模型。这既是政策也是现实限制——听起来像某个知名角色的声音,是最快挨下架通知的路,而且各家公司正盯着这件事。
它也不会替你发明你没写出来的喜剧节奏。渲染器会按你要求的语速念你给的那句话。如果这个梗在纸上就不好笑,念出来会明确地告诉你——这大概正是这类工具最有用的地方。
卡通喜剧靠的是反应,所以把反应单独写成台词,而不是塞进舞台提示里。单独一行两个字的台词能拿到一次完整表演,一句括号里的注解拿不到。
挑音高和语速离得很远的音色。如果两个角色台词往来很多,一定要让听众闭着眼也能分清谁在说——在音频里,这是唯一有意义的测试。
所有候选都用同一句梗来试,而不是念一句平淡的句子。有些音色念旁白很漂亮,一到笑点就把它念平了。
喜剧就是节奏。把大坏蛋放慢,把小跟班加快,情绪按句设置,让慌乱的地方读出来是慌乱,而不只是音量变大。
想快点分享就拿整段成片;如果你要对着音频做动画、需要单独挪某几句,就拿按角色的分轨。
可以,音色库两头都备了料,你还能靠音高和语速再往外推。做不到的是拿一个中性成年音色硬降三个八度还不带塑料感。请从本来就接近目标的音色出发。
适合,而且这是最常见的用法之一。语速要比你直觉上觉得合适的再慢一点,也别把三个高音色连着排在一起——在小喇叭上听很快就累。
单次渲染里不行。台词叠着说属于混音决定,所以请导出分轨,在剪辑软件里让它们重叠。分轨导出在 Studio 套餐。
把他存成角色卡:名字、人物设定、音色和默认情绪一起打包。新建项目时把卡片放进去,第四集听起来就和第一集一样。
单次渲染的限制很宽松,真正的约束是你每月的分钟数。免费五分钟,Creator 六十分钟,Studio 两百分钟。一个五分钟的卡通本子大约就消耗五分钟,所以按成片时长来规划,别按字数。
任何付费套餐都可以,商用授权已含在内,也没有水印。免费套餐仅限个人用途,导出会打上一小段音频水印。