音色分类

搞笑音色生成器

一个搞笑的声音单独摆着只是个新鲜玩意;一个搞笑的声音去接一个正经的声音,才是一个笑点。CastDub 在同一个项目里把一来一回两边都配上,你可以立刻听到节奏,不用再拼片段然后祈祷。

先从这四把音色开始

Noor

Noor

所有倒霉事都发生在他身上的正经人

清晰中性

公开试听音频还在制作中,样音暂为占位。所有套餐都能用到全部音色——音色库不是付费墙。

喜剧是结构,而结构可以测

每个真正在写喜剧的人都会告诉你同一件不浪漫的事:笑话是改出来的,不是写出来的。一个段子的第一版几乎从不是最后那版,而找到那一版的唯一办法就是一遍遍念出来听。过去这需要一屋子人,所以喜剧写作一直又慢又依赖社交。

把「念出来」交给生成,就把排期从这个循环里拿掉了。过去约一次围读的时间,现在能听四个版本的笑点,而且是用预设的音色听,不是用你自己的嗓子。这不会让你变得更幽默,但它把反馈循环压得足够紧,让你能真的查出来什么好笑。

选角就是选那个错配

多数经久耐用的喜剧配音都跑在音区错配上。为电影预告做的声音在描述一个三明治。温柔的儿童旁白在发出威胁。一个怒到极点的角色用图书馆音量说话。幽默在「怎么说」和「说什么」的落差里,而这个落差是一个三十秒就能做完的选角决定。

推论是:一个本身就很滑稽的声音通常反而是更弱的选择。尖细的声音说荒谬的话,是两个笑点叠在一起,会互相抵消。把荒谬的内容交给严肃的声音,看看会发生什么。

真正能控制的节奏

CastDub 逐句渲染、句间留空隙,也就是说你的排版就是你的节奏。你想让观众坐在里面的那个停顿,会变成一个空拍;快速来回则是一串短句、不留空白。如果某个笑话依赖有人插话,就把插话写成一句从半句开始的台词——即便音频没有重叠,听众也会听到那个截断。

真要重叠,就导出分轨,在剪辑软件里把它们叠上去。这是喜剧确实需要多轨的一处,因为抢话是一种没法顺序假装出来的喜剧手法。

限制在哪里

笑声本身仍然很难。生成的笑是整套工具里最容易被听出是合成的声音,因为笑本质上是呼吸事件,不是语音事件。如果你的段子需要一声笑,自己录一条剪进去,没人分辨得出来,而且只要十秒。

另一个限制是渲染器救不了一个不好笑的笑话。这听起来像批评,其实是这个工具最有用的性质:听到自己的文字被平淡地念出来,会剥掉你脑子里那个版本——而那个版本几乎总是比纸上的更好笑。

几步就能把剧本变成音频

  1. 先写那个正经的角色

    喜剧是铺垫加反应。先决定哪个音色是锚,然后把它配得尽量无趣——搞笑的那个需要一块平的墙去弹。

  2. 为错配而选角

    最稳的笑点是声音和内容不搭:用预告片男中音宣布早餐,用欢快的声音报坏消息。试听时要试这个错配,而不是单独找「最好笑的声音」。

  3. 把停顿单独放一行

    节奏就是换行。把笑点前那一拍拆成单独一句,观众预期的那个空隙才真的存在。

  4. 同一个笑点试三种演法

    把同一句笑点分别渲成中性、兴奋和冷面。冷面赢的次数比多数人以为的多,这也是为什么试听比调参数重要。

  5. 导出后找个人试

    喜剧是唯一你判断不了自己节奏的类型。导一段 MP3,发给一个人,看他在哪儿开始听不下去。

常见问题

AI 音色真的能搞笑吗?

搞笑的不是声音,是文字和节奏。这类工具给你的是几分钟内就能验证节奏,而不用约两位演员。这把喜剧写作变成一个可以反复迭代的过程,而喜剧只有这样才会越写越好。

最大的错误是什么?

让两个搞笑的声音互相对着演。没有正经人,观众就没有衡量荒谬的基准,一切都摊平成噪音。一场戏至少要有一个锚。

冷面演法怎么弄出来?

情绪留在中性,语速稍微降一点。多数人把喜剧导过头了——他们给一句台词加兴奋,而那句话如果像什么怪事都没发生一样念出来,会更好笑。

能模仿真人吗?

不能。克隆或模仿可识别真人的声音违反我们的条款,即便是戏仿也一样,因为这段音频一旦离开你的项目就和真录音无法区分。写一个原创角色吧,笑点通常还在。

渲染器懂讽刺吗?

光看文字不懂。请明确标出这句的情绪,或者把它写成结构性的讽刺——平淡的演绎配上荒谬的陈述,不需要任何声音上的暗示,本身就读作讽刺。

做一档小品播客要哪个套餐?

Creator 足够撑一档周更小品节目:五位配音成员、每月六十分钟、无水印。如果想把声音摆进立体声场就上 Studio——这件事在小品里比多数人以为的更重要。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。