
Dorian
念叙述部分的文学男中音
听众对全阵容作品的评价一直高于单人朗读,而出版社很少做,因为一套阵容会把棚时、排期和成本都翻上去。让单人朗读成为默认的是经济,不是偏好。任何给全阵容制作问过价的独立作者,都清楚这个账多快就算不过来。
把表演交给生成,改变的是这个约束。一套阵容和一个旁白一样贵,于是决定变成纯编辑判断:这本书会因为声音各不相同而更好吗?对白密集的小说答案几乎总是「会」,群像奇幻更是斩钉截铁地「会」,因为「八个角色靠耳朵分不清」恰恰是读者最常抱怨的事。
三件事吃掉了大部分精力。发音校对,凡是有自造词汇或不常见人名的书都躲不掉。选角,值得慢慢做,因为选错旁白会毒掉整部作品。以及听——真的按正常速度把每一章听完,这是大家会跳过、然后后悔的一步。
真正消失掉的是录音和重录那个循环。过去第九章改个错字意味着一次补录,现在意味着重渲一句。就是这一个变化,让不是音频专业出身的人也能独立做出有声书。
把章当成一切的最小单位:渲染、检查、版本管理和修改。请留一份简单的清单记下每章处在哪个阶段,因为四十章的书状态真的很难全装在脑子里,而唯一一章没检查的,就是听众会找到的那一章。
渲染设置应该跨章完全一致,而这正是角色卡发挥价值的地方:它带着音色、语速和默认情绪,于是第三十一章和第二章是一致的,谁也不必记得三月时选了什么。
市场对合成朗读的态度正在快速变化,唯一安全的姿态是透明。标出来。写在简介里,而不只是塞在元数据里。能接受合成朗读的读者照样会买;不能接受的,反正第一章就会发现。
标注还有一个手艺上的理由:它设定了正确的预期。知道自己在听什么的听众,会用正确的标准去评判它——一版清晰、一致、选角得当的朗读——而不是拿它去比它从来没打算成为的那种表演。
纸质读者靠眼睛导航:他们看见章节分隔、小节分隔、视角切换。听众什么都看不见,所以结构必须由音频来承担。章节标题单独占一句、后面留真实的停顿。场景转换处留更长的空隙。视角切换要有一个固定的提示方式,而在全阵容作品里,这可以直接是换一个旁白。
前置内容特别值得琢磨。长长的献词、引语和致谢摆在有声书开头,正是听众放弃的地方,因为他们还不在意这些。多数音频版把它们挪到末尾,任何不属于故事的内容都值得这么处理。
按你将来发布的单位干活。一章正好是改完之后重渲的大小,也正好是一次听完能检查完的大小。
旁白承担了绝大部分时长。请拿你最密的那一段试听,并且完整听三分钟再决定。
自动分配会识别散文里的引号对白和引述语,于是「她说」这类归属就变成角色分配。改掉它弄错的,改动会留住。
把所有人名、地名和自造词收齐,逐个确认怎么念,一次改对。这里的二十分钟能省下后面几章的重渲。
每章导成一个文件,如果你想做同步文本版就顺手导字幕。最后按你发行渠道的规格组装。
任何付费套餐都附带生成音频的商用权利。至于某个具体平台是否接受合成朗读,是另一个答案还在变的问题——几家大平台现在接受但要求标注,另一些不接受。请在开工做四十小时之前先确认你发行渠道的当前政策。
越来越是必须,而且无论如何你都该声明。多数允许合成朗读的平台都要求标注,而买了之后才发现的听众,会留下你能想到的那种评价。
这正是这个工具的全部意义。传统有声书是一个人演所有角色;这里每个角色是真的不同音色,长对话场景会好跟得多。
渲染很快,活儿在选角、发音校对和听。一本常规长度的小说预计要一两天的实际投入,而其中大部分花在检查上,不是生成上。
让它们各占一句,中间刻意留停顿。非虚构尤其容易在这里崩——标题连进正文,听众就丢掉了他们在纸上本来能看见的结构。
Studio。每月两百分钟大约是三到四小时成片,而且你会需要分轨导出,这样一句念错的台词能替掉,而不必重渲整章。