流程

剧本转对白音频

剧本是一份表演计划,默读它几乎什么都告诉不了你。让分得开的声音把它演出来,三十秒内你就知道行不行——而现在把这件事安排好,差不多也就这么久。

为什么这条路子在这儿行得通

一个人也能开的围读会

围读会存在,是因为编剧听不见自己写的台词。把五个人凑到一个房间里念一遍初稿,是编剧能拿到的最有价值、也最难约到的反馈;渲染同一场围读只要几分钟,而且每改一稿都能重来。

标准剧本格式不用转换

台词上方全大写的角色名、括号提示、场景标题——标准排版会被直接解析。你不用先去掉格式,也不用把一场戏重搭成一张列表。

台词的问题变得听得见

在纸上,两个说话方式一样的角色看起来不同,因为名字印在那儿。在音频里他们就是同一个人,而这恰好是你想要的诊断结果:你自己用耳朵分不出来,观众也分不出来。

产出是能用的,不只是一次测试

同一次渲染可以当动画的参考音轨、提案物料、给演员的排练参考,或者一部舞台剧的成品音频版。输出不是一次性的。

适合这类活儿的音色

Kestrel

Kestrel

低沉疲惫的女剑客,这场仗她已经输过一次

女声成年美式英语戏剧粗砺
Torvald

Torvald

命令真能被执行的骑士团长

男声成年英式英语英气奇幻
Cass

Cass

十七岁,正为此愤怒,是好的那种愤怒

女声少年美式英语少年现代
Juno

Juno

边想边说、从不念稿的播客主持

女声青年美式英语播客口语
Ashford

Ashford

天鹅绒嗓音的反派,毁掉你之前先道个歉

男声成年英式英语反派顺滑
Noor

Noor

把说明密集的段落交给新闻播报级的清晰度

女声成年美式英语新闻清晰
Sable

Sable

给自己那些糟糕决定配旁白的黑色电影女侦探

女声成年美式英语黑色电影烟嗓
Hazel

Hazel

妈妈音:耐心,然后突然就不耐心了

女声成年美式英语温暖家常

浏览整个音色库 →

具体怎么做

  1. 按标准格式贴进来

    剧本排版会按原样解析。场景标题和动作描述可以交给旁白,也可以完全排除。

  2. 决定动作描述怎么处理

    做围读就让旁白念出来,做参考音轨就直接丢掉。两者都只是一个设置。

  3. 按分得开选角,不按顺眼选角

    两个在纸上读起来相似的角色,听起来必须不同。这个练习存在的意义就是这一道检查。

  4. 整场连着渲染

    别中途停下来修台词。先按完整长度听一遍整场;节奏问题只有连续听才会露出来。

  5. 标出节拍

    第二遍:把戏发生转折的那三四句导一下,其余全部留中性。

  6. 按用途导出

    要反馈就导成片,做动态分镜拿分轨,做提案视频导字幕。

编剧面前的那道反馈鸿沟

所有戏剧媒介的创作者都面对同一个问题:他们交出的成品,不是观众收到的成品。剧本是指令。这些指令能不能造出一场好戏,取决于表演,而表演既贵又难安排,所以大多数剧本在被任何人听到之前,已经改了很多遍。

传统的解法是围读会,而它太有效,以至于正规制作会围着它排期。难点在于门槛:围读要好几个人、要一个大家都有空的时间,还要一份你愿意拿出来给人看的稿子。项目早期的编剧一样都没有——而那恰好是听一听台词最有帮助的时候。

听一场戏能听出什么

三件事立刻浮出来。长度——纸上读着轻快的戏,念出来经常长一倍,而这个差别是被感觉到的而不是被量出来的。声音辨识度——两个角色听起来一样,他们就是一样,纸上写多少人物小传都补不回来。还有铺陈——读起来自然的信息,讲出来常常难以忍受,因为听众没法跳读。

第四件更隐蔽:节奏。好的台词句长有起伏,而一场每句都差不多长的戏会长出一种机械脉搏,在文字里看不见,在音频里明摆着。听一次,比读多少关于这件事的建议都值。

怎么用生成的朗读而不被它误导

它的失效模式是被当成一次表演。它不是——它是一次以稳定语速进行的中性朗读,而这恰好让它成为好的诊断工具和差的细腻程度裁判。在这里听起来平的一句,交给知道该怎么演的演员可能极好;在这里听起来还行的一句,也可能其实什么都没做到。

有用的问题都是结构性的:我跟得上吗,我分得出谁在说吗,是不是太长了,信息到达的顺序能不能用。这些问题它答得可靠。关于细腻层次的问题它完全答不了,硬当它答了,结果就是把本来很好的素材改坏。

不止影视剧本

同一套流程覆盖舞台剧、广播剧本、游戏对白表和交互小说。游戏文本尤其受益,因为它是以表格而不是场次写的,而且通常到制作很晚期才第一次被听到,那时结构已经定死了。

舞台写作有自己的用处:一场戏的朗读版本能让导演在选角之前有个可以反应的东西,而现在新剧本扶持项目普遍会传阅投稿剧本的音频版,而不是让评审自己去想象。

在编剧团队里用朗读版

朗读版在协作写作里有个意外的用处:把一场戏以音频而不是纸稿传阅。不肯读同事八页初稿的人,愿意在通勤路上听四分钟,而回来的意见明显不一样——更多关于节奏和清晰度,更少关于逐句措辞。

这种转变在项目的结构阶段特别有用,因为那时磨句子本来就还太早。已经有好几个电视剧编剧团队正是为此传阅大纲场次的音频版。

把一场戏的时长量准

编剧常用「一页一分钟」的经验法则,这对动作段可靠,对对白段不可靠,因为表演速度随演法变化极大。一次朗读给你的是一个真实数字而不是估计,这在有硬性长度限制的形式里最要紧:十分钟短片、一条广告、一次电影节投稿。

把这个数字当下限而不是确数。生成的对白比真人快、也更均匀,不会为动作、反应,或者演员在一句难台词前的那一口气而停。渲染出四分钟的一场戏,真演起来通常四分半到五分钟。

如果你是在按时长删,真正有用的发现几乎总是「哪一段感觉长」,而不是「哪一段实际长」。这两件事不一样,而只有听才能找到前者。

要花多少钱

Free

$0 / 月

够你做完一场短戏,听听自己的剧本配上音色是什么样。

  • 每月 10,000 字符——额度每月重置,不是一次性试用
  • 每个项目 2 个角色
  • 5 分钟成片
  • 导出带一段很短的 CastDub 水印
免费开始

Studio

$29 / 月

给连载类的活儿:长篇有声剧、有声书、配音流水线。

  • 每个项目角色数不限
  • 每月 200 分钟成片
  • 逐句情绪控制
  • 多轨与分轨导出(每个角色一条 WAV)
  • 3 个声音克隆槽位
选择此套餐

Team

$69 / 月

给编剧、导演和剪辑一起碰同一个项目的工作室。

  • 5 个席位,项目与角色卡共享
  • 每月 500 分钟成片
  • 10 个声音克隆槽位
  • 优先渲染队列
选择此套餐

完整对比 →

常见问题

它能代替真人围读会吗?

不能,也不该去试。一屋子演员给你的是解读、疑问,以及所有人在你以为很严肃的一句上齐声笑出来的那个瞬间。这里给你的是结构性的那一半——节奏、清晰度、角色是否分得开——但任何时间都能拿到,而且每改一稿都能重来。

它会念舞台提示吗?

你想让它念才念。做完整围读就把动作描述分给旁白,只要对白的参考音轨就把它们排除。括号里的提示按导演提示处理,不会被念出来。

能当动画的参考音轨吗?

可以,而且是常见用法。按生成的音轨做动画,之后再换成真人录音——时长不会完全对上,所以要预留一遍调整,别指望直接替换。

支持哪些格式?

标准剧本排版的纯文本、「人名:台词」成对的写法,以及带对话标签的散文。大多数编剧软件导出的文本,不用改就属于第一类。

能把渲染结果分享给合作者吗?

导出文件,按你平时的方式发过去。本期没有协同编辑功能;Team 套餐的席位可以共享项目,但评审流程仍然是导出再发送。

时长会和真人表演一致吗?

大致一致。生成的对白比真人略快、也更均匀,而且不会为了动作或反应而停顿。做粗略计时它很可靠;用来锁画面则不行。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。