
Aria
会给自己打戏配旁白的少年漫主角
动漫的台词密度特别高。四页的一场戏可能同时有主角、对手、两个配角、一个画外播报和一个旁白,一半的笑点就来自声音切换得有多快。把这种本子丢给单音色的文字转语音,每句话都是同一个调门,于是分配角色这件事又回到了读者自己脑子里——而这本来正是你想让工具替你做的事。
大家想出来的土办法是:一个角色跑一遍,下载一堆片段,再在音频软件里手工拼。能用,但一场戏要耗掉一个下午,而且只要改一句台词就得重来。CastDub 存在的理由就是这个循环,而不是音质本身——真正卡住你的一直是它。
自动分配要回答两个问题:谁在说话,他该是什么声音。说话人识别覆盖了大家真实会写的几种格式——「角色名:」前缀、角色名居中的分镜格式,以及带「她轻声说」这类引述语的小说体。这不是魔法:如果你这场戏里是黑暗中三个没有名字的声音,那还是得你自己标。
第二半是推荐。音色库里每个音色都带着人物设定、年龄段和一组风格标签,所以一个被写成「无所谓的十七岁」的角色,会去和带着「干」「凌厉」标签的少年音色比,而不是去和温厚的旁白比。每一条推荐你都能改,改完会在整个项目里生效——一个角色换一次音色,这个项目里后面每一场戏都跟着换。
围读和表演的差别,大半在节奏和强度上。CastDub 把情绪当成「按句」的属性:这句中性,这句兴奋,这句压着嗓子的耳语就真的是耳语。这种颗粒度在动漫里比几乎任何题材都重要,因为这个类型的喜剧惯例就是硬切——一个角色刚吼完,下一秒就开始嘟囔。
逐句情绪控制是付费功能,这是故意的。免费套餐给你自动那一遍,足够验证一场戏立不立得住。手动导戏是把「能用」变成「敢发」的那一步,所以它和多轨导出一起放在 Studio 套餐里。
关于写作的一条实用提醒:情绪标签救不了一句同时干两件事的台词。如果一句话开头是愤怒、结尾是难过,就把它拆成两句。渲染器把每一句当成一次完整的表演,真人演员也是这么处理的。
最常见的三种:发在视频站和 Discord 的同人有声剧、在画手和写手社群里流传的原创角色小剧场,以及还没预算请配音、先拿占位音顶上的独立视觉小说。三者的处境是一样的:一个人、没有录音棚、本子还在不停改。
同人创作里安全的地界是原创剧本加原创角色,或者在宽容度较高的圈子里做二次创作;危险的地界是克隆某位具名配音员,或者转发有版权的官方配音。前者这个工具随你做,后者正是我们的声音克隆政策要拦住的东西。
你平时怎么写就怎么贴——分镜剧本格式、带引号的小说体,或者一行行「角色名:台词」都行。CastDub 不要求你套模板。
自动分配会把整场戏拆成一个个说话人,再按你写的人物描述给每个人推荐音色。剧本里写着这人十五岁、正在气头上,就不会给你配一个四十岁的旁白。
点开某个角色,用同一句台词连着试听四五个候选,留下最像你心里那个人的。换掉之后,整场戏会跟着一起更新。
动漫台词靠的就是突然变调——一句玩笑说到一半变成威胁。情绪按句设置而不是按角色设置,这个转折才立得住。
整场戏导成 MP3 或 WAV,也可以取分轨,把对白铺到你自己的音乐和音效上面去剪。
它给你的是一版干净、好调的读稿,更接近剧本围读,而不是成品播出版。合成音和真人差距最小的是日常对话,最大的是尖叫、哭泣和长音。如果你这场戏全压在这些地方,建议这几句自己录,其余交给 CastDub。
可以,但要靠挑一个本来就是这个口音的音色,而不是靠把拼写改歪。为了逼出口音而用谐音写台词,通常只会得到一个刻板印象,还会连带把发音搞坏。挑音色,拼写照常写。
你可以生成一条配音轨,再在剪辑软件里对齐。付费套餐支持导出 SRT 时间轴,大多数人就是靠这个对轴的。但版权要留神:给有版权的番配音再商用发布,是任何工具都替你解决不了的授权问题。
免费套餐每个项目两位配音成员,够撑一场两人对手戏。Creator 提到五位,Studio 不限。同人场景一般是三到六个说话人,所以 Creator 能覆盖相当多人的需求。
只有在对方明确、留有记录地同意时才可以,而且公众人物和有版权的表演一律不行。克隆不属于你的声音,是让项目最快被下架的办法。我们的声音克隆流程会先要求一段录好的授权声明,才肯开始建模。
付费套餐会给你生成音频的商用授权。免费套餐仅限个人非商业用途,导出会带一小段水印。剧本无论哪种情况都是你的——我们不会对你的文字主张任何权利。