音色分类

有声书配音生成器

单人朗读成为标准,是因为请一整套阵容太贵,而不是因为听众更喜欢它。CastDub 让一个人就能做出有真实阵容的那一版——叙述交给旁白,每个角色一个独立音色——素材就是你手上已有的那份书稿。

先从这四把音色开始

公开试听音频还在制作中,样音暂为占位。所有套餐都能用到全部音色——音色库不是付费墙。

全阵容有声书为什么又少又受欢迎

听众对全阵容作品的评价一直高于单人朗读,而出版社很少做,因为一套阵容会把棚时、排期和成本都翻上去。让单人朗读成为默认的是经济,不是偏好。任何给全阵容制作问过价的独立作者,都清楚这个账多快就算不过来。

把表演交给生成,改变的是这个约束。一套阵容和一个旁白一样贵,于是决定变成纯编辑判断:这本书会因为声音各不相同而更好吗?对白密集的小说答案几乎总是「会」,群像奇幻更是斩钉截铁地「会」,因为「八个角色靠耳朵分不清」恰恰是读者最常抱怨的事。

仍然要花真功夫的部分

三件事吃掉了大部分精力。发音校对,凡是有自造词汇或不常见人名的书都躲不掉。选角,值得慢慢做,因为选错旁白会毒掉整部作品。以及听——真的按正常速度把每一章听完,这是大家会跳过、然后后悔的一步。

真正消失掉的是录音和重录那个循环。过去第九章改个错字意味着一次补录,现在意味着重渲一句。就是这一个变化,让不是音频专业出身的人也能独立做出有声书。

以章为单位的纪律

把章当成一切的最小单位:渲染、检查、版本管理和修改。请留一份简单的清单记下每章处在哪个阶段,因为四十章的书状态真的很难全装在脑子里,而唯一一章没检查的,就是听众会找到的那一章。

渲染设置应该跨章完全一致,而这正是角色卡发挥价值的地方:它带着音色、语速和默认情绪,于是第三十一章和第二章是一致的,谁也不必记得三月时选了什么。

标注与读者预期

市场对合成朗读的态度正在快速变化,唯一安全的姿态是透明。标出来。写在简介里,而不只是塞在元数据里。能接受合成朗读的读者照样会买;不能接受的,反正第一章就会发现。

标注还有一个手艺上的理由:它设定了正确的预期。知道自己在听什么的听众,会用正确的标准去评判它——一版清晰、一致、选角得当的朗读——而不是拿它去比它从来没打算成为的那种表演。

让听众能导航的结构

纸质读者靠眼睛导航:他们看见章节分隔、小节分隔、视角切换。听众什么都看不见,所以结构必须由音频来承担。章节标题单独占一句、后面留真实的停顿。场景转换处留更长的空隙。视角切换要有一个固定的提示方式,而在全阵容作品里,这可以直接是换一个旁白。

前置内容特别值得琢磨。长长的献词、引语和致谢摆在有声书开头,正是听众放弃的地方,因为他们还不在意这些。多数音频版把它们挪到末尾,任何不属于故事的内容都值得这么处理。

几步就能把剧本变成音频

  1. 把书稿按章拆开

    按你将来发布的单位干活。一章正好是改完之后重渲的大小,也正好是一次听完能检查完的大小。

  2. 先定旁白,别的都靠后

    旁白承担了绝大部分时长。请拿你最密的那一段试听,并且完整听三分钟再决定。

  3. 让它自己找对白

    自动分配会识别散文里的引号对白和引述语,于是「她说」这类归属就变成角色分配。改掉它弄错的,改动会留住。

  4. 过一遍发音

    把所有人名、地名和自造词收齐,逐个确认怎么念,一次改对。这里的二十分钟能省下后面几章的重渲。

  5. 渲染并组装

    每章导成一个文件,如果你想做同步文本版就顺手导字幕。最后按你发行渠道的规格组装。

常见问题

AI 朗读的有声书能卖吗?

任何付费套餐都附带生成音频的商用权利。至于某个具体平台是否接受合成朗读,是另一个答案还在变的问题——几家大平台现在接受但要求标注,另一些不接受。请在开工做四十小时之前先确认你发行渠道的当前政策。

必须声明是 AI 朗读吗?

越来越是必须,而且无论如何你都该声明。多数允许合成朗读的平台都要求标注,而买了之后才发现的听众,会留下你能想到的那种评价。

能给每个角色配不同音色吗?

这正是这个工具的全部意义。传统有声书是一个人演所有角色;这里每个角色是真的不同音色,长对话场景会好跟得多。

一本小说要做多久?

渲染很快,活儿在选角、发音校对和听。一本常规长度的小说预计要一两天的实际投入,而其中大部分花在检查上,不是生成上。

脚注、标题和前置内容怎么办?

让它们各占一句,中间刻意留停顿。非虚构尤其容易在这里崩——标题连进正文,听众就丢掉了他们在纸上本来能看见的结构。

该用哪个套餐?

Studio。每月两百分钟大约是三到四小时成片,而且你会需要分轨导出,这样一句念错的台词能替掉,而不必重渲整章。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。