音色分类

游戏角色配音生成器

游戏里其实没有「场」,只有「表」:两百句台词分属四十个角色,下个月再加五十句时还得听起来是同一批人。CastDub 就是照着这个形状做的——分配一次、把分配结果留住、批量渲染。

先从这四把音色开始

Nova

Nova

读过你档案、并不觉得你厉害的舰载 AI

机械科幻
Grit

Grit

某个很大的东西,刚刚注意到了你

怪物低沉

公开试听音频还在制作中,样音暂为占位。所有套餐都能用到全部音色——音色库不是付费墙。

游戏对白是流程问题,不是表演问题

去问任何一家小工作室「配音为什么贵」,他们第一句都不会说棚费,而会说改。第九周改了一句台词,演员排不出时间,新录的一条和旧的房间底噪又不搭,于是本来要补一句,现在得补三句。合成音对独立团队最大的吸引力,主要是把这个循环压缩到几秒钟。

但前提是工具得尊重流程。四十个叫 export-1.mp3 的文件送到你手上,只是把活儿挪了个地方,没有消掉。CastDub 会把你的标识一路带过渲染,出来的东西能直接落进你已有的工程结构里。

长周期项目里的一致性

合成音在游戏里的失效方式不是音质,而是漂移。玩家能原谅一句略平的读法,但第二章里铁匠换了个人,他立刻就能听出来,因为人的听觉恰恰对这个最敏感。

角色卡的存在,就是让漂移在结构上变得不太可能。一张卡装着这个角色的音色、默认情绪、语速,以及他专属词汇的发音修正。第六个月来了个新编剧要加台词,他是把台词挂到卡片上,而不是重新挑音色,于是声音这件事一点也不靠谁的记性。

钱该花在哪儿

请诚实看待合成音不擅长什么,预算就该花在那儿。它弱在身体性的用力——疼、发力、笑、哭——也弱在很长的情绪独白,那种全靠演员的处理撑起来的戏。它强在游戏剧本里那一大片中间地带:商人、教学、任务文本、环境闲聊、系统喊话。

几个小团队在用的务实分法是:全部先生成,次要角色就用生成版发出去,故事真正依赖的那两三个角色请真人。生成版顺便还能当参考轨,让演员进棚前就知道节奏。

法律底线

两条规矩能让项目不出事。不要克隆你没有书面许可的声音,包括别的游戏里的配音员。也不要在宣发里把某个生成的音色说成是某位知名演员的声音——那是形象权问题,和音频是怎么做出来的无关。

如果你确实和真人演员合作、并且想把克隆当补录工具,合同里必须明确写出来,写清范围,也写清项目结束后模型怎么处理。我们的声音克隆政策页写了建任何模型之前必须走的授权流程。

几步就能把剧本变成音频

  1. 对话按你现有的样子拿进来

    多数团队把对话存在表格或 Yarn/Ink 文件里。粘贴一列「角色名:台词」,CastDub 会把它当成一份角色表,而不是一段散文。

  2. 用角色卡把阵容锁住

    每个 NPC 变成一张卡,装着他的音色、默认情绪和语速。卡片就是你复用的单位,于是新手村的守卫和第三章的守卫是同一个守卫。

  3. 批量渲染

    一次生成某个角色的全部台词,成组地检查。一致性问题只有在你连着听四十句时才会暴露,单句检查永远听不出来。

  4. 按你的引擎给文件命名

    导出会带上源文件里的角色标识和台词标识,所以导进 Unity、Unreal 或 Godot 时不用手工重命名两百个文件。

  5. 只重渲改过的部分

    策划改了八句,就重新生成这八句。其余台词保留现有音频,构建版本不会跟着翻来覆去。

常见问题

生成的音色能用在商业游戏里吗?

任何付费套餐都可以,商用授权覆盖把音频随游戏一起发行。请留一份记录说明生成时用的是哪个套餐,另外不要把免费套餐的音频发出去——它带水印,授权也只限个人用途。

怎么防止一个 NPC 前后不像同一个人?

用角色卡,别每次重新挑音色。跑偏几乎总是因为几周后有人挑了一个「差不多但不一样」的音色,而不是模型本身在变。

战斗喊话和闷哼怎么办?

短促的战斗发声是合成音最弱的一块——闷哼、尖叫、发力声本质上是身体噪音,不是语音。要占位可以生成,但请在上线前留出预算,用真人录音或音效库替掉。

有口型同步需要的时间戳吗?

字幕导出会给你句级时间轴,够做简单的开合口型和字幕显示。全套口型同步需要的音素级数据,这一期还没有。

能处理自造的奇幻或科幻名字吗?

它会猜,而且凡是不常见的都会猜错。每个项目里把发音改一次,这个词出现的所有地方都会跟着对——对一个有自造世界观的游戏来说,这件事值得第一天就做。

我能用到多少个音色?

音色库对所有套餐都是同一套,没有哪个套餐给你更多音色。付费换来的是每个项目更多配音成员、情绪控制和克隆位。我们不把音色列表本身做成付费墙。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。