流程

视觉小说配音

视觉小说在游戏里有着最糟的一组比例:台词量巨大,分支结构让大多数玩家只能听到你写的一小部分,而预算根本不可能把全部配完。这个形状,正是这里要解决的。

为什么这条路子在这儿行得通

台词量不再是限制

一部中等体量的视觉小说,各条分支加起来可以有两万条台词。按常规方式配完,几乎任何独立团队都做不到——这也是大多数视觉小说只有部分配音或者干脆没有配音的原因。

分支之间保持一致

玩家会互相比较路线。一个角色在第二周目听起来稍有不同,代入感就彻底断了;角色卡让每条分支完全一致,无论它是什么时候写的。

导出的文件名对得上你的引擎

导出文件带着你源文件里的角色与台词标识,所以把它们扔进 Ren'Py 项目或 Unity 构建时,不需要给几百个文件改名。

改稿很便宜

视觉小说的剧本在测试期一直在变。重渲八条改动过的台词是几秒钟的事,而补录一次真人则要一周。

适合这类活儿的音色

Ezra

Ezra

视觉小说里的恋爱对象,说实话前总要停两秒

男声青年美式英语视觉小说柔和
Lumen

Lumen

VTuber 人格:表面可爱,底下冷面

女声青年美式英语VTuber动画
Cass

Cass

十七岁,正为此愤怒,是好的那种愤怒

女声少年美式英语少年现代
Seraphine

Seraphine

把礼貌当武器的宫廷公主

女声青年英式英语宫廷奇幻
Koji

Koji

对手角色:话短、好胜、暗地里讲义气

男声少年美式英语动画对手
Tess

Tess

语气平直干脆的澳洲女主角

女声青年澳式英语口音干冷
Vex

Vex

用讲道理的口气跟你谈条件的恶魔

中性成年美式英语恶魔恐怖
Wren

Wren

睡前故事旁白,缓慢温暖,从不把人吵醒

女声成年美式英语旁白温暖

浏览整个音色库 →

具体怎么做

  1. 导出你的对白表

    大多数引擎都能把对白导成「说话人+台词」的行列表。这里要的就是这个格式。

  2. 给每个有台词的角色建一张卡

    包括只有五句的那些。让第三条路线听起来和第一条一样,靠的就是卡片。

  3. 按角色渲染,不按场次渲染

    把一个角色的全部台词一起生成,不一致的地方就会变得听得见——逐句听是永远听不出来的。

  4. 旁白单独留出来

    大多数视觉小说有一个内心独白式的旁白。把他放在和主角口头台词明显不同的音区里,否则玩家会把「想」和「说」搞混。

  5. 用你自己的标识命名文件

    让引擎的台词 ID 一路穿过渲染保留下来,导入就变成纯机械操作。

  6. 只重渲改过的部分

    改稿之后只重新生成受影响的那几条。其余保持原有音频,你的构建也就保持稳定。

塑造了这个门类的经济账

视觉小说以文本为先,既是传统也是必然。这个形式成长于一个配音很贵、台词量又极大的市场,于是惯例变成了部分配音:主线配上,支线内容静音,主角不出声好让玩家代入。

这些惯例现在既是经济的也是审美的——很多玩家就是偏好它们——但底下那道限制确实变了。一个小团队现在配得起过去只能留白的素材,而那主要是支线路线和次要角色,而不是主线。

分支让一致性比看起来更难

线性故事是按顺序听一遍。分支故事是被打乱顺序、反复地听,而且玩家是刻意在对比不同版本。第二个月写的一句和第九个月写的一句,会被任何走第二条路线的人连着听到。

这让声音漂移比在线性游戏里显眼得多。任何依赖「有人记得当时怎么选的」的机制,最终一定会失效。把声音和角色存在一起、渲染时绝不重新选音色,才是能防住它的流程规矩。

把渲染这一步塞进引擎流程

实际的集成问题是文件命名。引擎按标识引用音频,而一个只会返回顺序编号文件的渲染步骤,是把你的工作挪了个地方而不是替你做掉了。让自己的标识穿过渲染,导入就变成一次复制操作。

第二个问题是增量渲染。视觉小说剧本在测试期的变动远多于大多数游戏内容,每次改动都全量重渲既慢又会搅乱构建。只渲差量、其余保持不动,你的音频目录在两次构建之间就是稳定的。

告诉玩家他们听到的是什么

视觉小说社区对配音意见很强,部分原因是配音演员是这个门类文化里显眼且被爱的一部分。在这种语境下生成配音不是中性的,而人们的反应很大程度取决于团队有没有一开始就讲清楚。

写在商店页面上。说明哪些部分是生成的,如果有真人录音的部分也说明是哪些。这样做的团队基本上是被按结果评价的;被事后发现的团队是被按「隐瞒」评价的,而后一种评价严厉得多。

部分配音是一个设计决定

既然全部配音已经负担得起,有意思的问题就变成了「该不该」。玩家读字比声音说话快,而全程配音的视觉小说要么强迫读者等,要么让他们跳过音频,而后者让配音本身失去意义。

行得通的做法是:给那些因表演而增值的地方配音——情绪场次、角色首次登场、路线高潮——把连接性的文本留静音,让读者按自己的速度走。很多口碑不错的商业作品正是这么做的,而且是刻意的,不是因为预算。

一个好用的判据:如果一句台词存在的目的是传递信息,静音就够了。如果它存在的目的是传递角色对这个信息的感受,就给它配音。

配合测试版本一起迭代

视觉小说的剧本在测试期变动比大多数游戏内容都多,因为测试者会找出读起来不顺的分支,而编剧会当场重写。一条跟不上的配音流程,最后会变成「不去修问题」的理由,而那是最坏的结果。

让这件事成立的性质是增量渲染:改八条、重生成八个文件、其余一动不动。你的音频目录在两次构建之间保持稳定,版本控制的差异也保持可读,没人需要纠结「这次改写值不值得重渲」。

这套东西值得在写作完成之前就搭好,而不是之后。等剧本锁死再搭的团队会发现,剧本永远不会锁死。

要花多少钱

Free

$0 / 月

够你做完一场短戏,听听自己的剧本配上音色是什么样。

  • 每月 10,000 字符——额度每月重置,不是一次性试用
  • 每个项目 2 个角色
  • 5 分钟成片
  • 导出带一段很短的 CastDub 水印
免费开始

Studio

$29 / 月

给连载类的活儿:长篇有声剧、有声书、配音流水线。

  • 每个项目角色数不限
  • 每月 200 分钟成片
  • 逐句情绪控制
  • 多轨与分轨导出(每个角色一条 WAV)
  • 3 个声音克隆槽位
选择此套餐

Team

$69 / 月

给编剧、导演和剪辑一起碰同一个项目的工作室。

  • 5 个席位,项目与角色卡共享
  • 每月 500 分钟成片
  • 10 个声音克隆槽位
  • 优先渲染队列
选择此套餐

完整对比 →

常见问题

该全部配音还是只配关键场次?

部分配音是既成惯例,玩家接受度也不错——公共线和情绪高点配上,零碎台词留静音。现在全配得起了,但值得想一想它是否真有帮助:没配音的台词读得更快,而习惯速通的玩家会感谢你没让他们等音频。

玩家会反感 AI 配音吗?

有人会,而视觉小说的受众对配音的意见比大多数群体都强烈。在商店页面明确说明是对的做法。相比一开始就说明,事后被发现用了没标注的生成配音,反应会糟得多。

支持 Ren'Py 吗?

没有插件,但流程是对得上的:导出对白、渲染、把文件放到你的 voice 语句期待的位置。让台词标识一路穿过渲染保留下来,就是让这件事成为机械操作而不是手工活的关键。

主角怎么处理?

大多数视觉小说让主角不配音,好让玩家投射自己。如果你的主角要配音,务必让内心独白和口头台词明显可分——用不同语速,或者在混音里做不同处理。

能先用它配试玩版,正式版再录真人吗?

可以,而且是合理的顺序。一个有配音的试玩版对众筹很有帮助,而这条生成音轨之后还能当作给演员的参考。如果计划是这样,就在试玩版里明确说明配音是临时的。

我需要哪个套餐?

Studio。角色数不限,这是视觉小说必需的;时长额度也要紧——两万条短台词,哪怕每条都很短,加起来也是很大一堆音频。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。