流程

把同人文变成有声作品

同人文对白密、靠人物驱动、体量还极大——这让它成了全世界最适合做成音频的虚构文本,偏偏最不被「一个旁白念到底」的工具照顾。

为什么这条路子在这儿行得通

每个角色都像自己

同人文之所以一直只被读不被听,是因为单个旁白恰好抹平了读者最想要的东西:两个特定角色之间的张力。把他们分开选角就把这层还回来了,而且只要几分钟,不用约录音。

带对话标签的散文直接就能用

同人文不是剧本格式。CastDub 会读引号里的台词和「她轻声说」这类标签,把它们转成角色归属,所以你可以从文档里直接整章粘过来,一个字都不用重排。

长篇也能保持一致

十万字的长篇意味着几十次渲染。有了角色卡,第四十章听起来和第一章一样——而这正是绝大多数长篇有声同人半途而废的死因。

贴合同人圈真实的发布方式

发有声同人就导成片,想配乐就拿分轨,要做成视频发到吃字幕的平台就导字幕。输出这边不假设你有一条专业产线。

适合这类活儿的音色

Cass

Cass

十七岁,正为此愤怒,是好的那种愤怒

女声少年美式英语少年现代
Ezra

Ezra

视觉小说里的恋爱对象,说实话前总要停两秒

男声青年美式英语视觉小说柔和
Lumen

Lumen

VTuber 人格:表面可爱,底下冷面

女声青年美式英语VTuber动画
Koji

Koji

对手角色:话短、好胜、暗地里讲义气

男声少年美式英语动画对手
Sable

Sable

给自己那些糟糕决定配旁白的黑色电影女侦探

女声成年美式英语黑色电影烟嗓
Wren

Wren

睡前故事旁白,缓慢温暖,从不把人吵醒

女声成年美式英语旁白温暖
Ashford

Ashford

天鹅绒嗓音的反派,毁掉你之前先道个歉

男声成年英式英语反派顺滑
Tess

Tess

语气平直干脆的澳洲女主角

女声青年澳式英语口音干冷

浏览整个音色库 →

具体怎么做

  1. 贴进一章

    散文就行,不用改成剧本。带归属标签的引号对白,正是自动分配角色最擅长的格式。

  2. 核一遍说话人识别

    散文里的归属比剧本含糊得多。渲染前先扫一眼分配结果,比事后返工快。

  3. 先定旁白和主角

    旁白承担全部叙述文字,必须和所有角色明显分开。先定旁白,再定撑起这篇文的那两三个角色。

  4. 存成角色卡

    第二章之前就存,别等到第二十章。长篇能做下来,全靠这些卡片。

  5. 只导关键节点

    同人文靠的是几个具体的情绪爆点。标出那些句子,其余留中性;这个对比才是读者来的原因。

  6. 按章导出

    按这篇文原本的连载节奏一章一章发。这样改稿也只花一章的代价。

同人文和音频为什么互相合适

有声同人——把同人文念出来——从同人圈有音频空间起就存在,也一直被同一件事卡着:录音本身花的时间不比听的短,还要加上剪辑。一万字的文大概是一小时成品音频,加起来好几个小时的工作量,而且是一个人演所有角色。

需求从来不是问题。同人文对白密度异常高,围绕两三个特定角色的关系搭建,消费场景又正好是音频最擅长的——通勤、家务、睡前。它可以说比大部分出版小说更适合做音频,之所以供给不足,只是因为制作全靠手工。

把角色分开选角,做到了一个人做有声同人做不到的事:让两个人的一场戏真的听起来像两个人。那正是读者来的具体理由,也是单旁白必然会丢掉的东西。

散文比剧本难分配角色

剧本会标出每个说话人,散文不会。散文靠归属标签,而一旦节奏建立起来就把标签省掉,于是一页来回对话在头两句之后可能一个名字都没有。人类读者毫不费力就能跟上,自动识别做不到。

实际做起来,说话人分配这一遍才是你要花注意力的地方。长段没有归属的对话、三人以上的对谈,以及用绰号或称谓代指角色的场面,是稳定的雷区。扫一遍分配结果花两三分钟,省下的是重渲。

还有一个写作侧的窍门值得知道:如果文是你自己写的、又打算做音频,把归属写得比散文风格要求的稍微明确一点,读者几乎无感,问题却整个消失了。

让这件事继续被欢迎的规矩

同人圈对二次创作的规范是非正式的,但大家守得很紧,而 AI 生成音频的出现让不少人有了合理的警惕。三个习惯能让你站在正确的一边:做别人的文之前先问作者,发布时署名,并且说明声音是 AI 生成的。

说明这一条比人们以为的更重要。一个本来乐意听 AI 有声同人的社区,如果是事后才发现声音是生成的,反应会非常糟糕——他们在意的是诚实,不是技术。

红线还是那条:不要克隆真人演员的声音。我们这里明令禁止,那也是版权方真会去追的事;一个圈子一旦落下这个名声,二次创作赖以存在的那点宽容就没了。

现实中的体量怎么算

按章想,不要按整篇想。一章既是一个可发布单元,也是一个可重渲单元和一个可试听单元,按这个方式组织项目,长篇才不会失控。

按时长而不是字数做预算。英文散文大约每 150 词对应一分钟成品音频,所以五千词一章大概三十三分钟。你的套餐每月时长是按这个数算的,而不是字数——这也是大多数人第一次做长篇时算错的地方。

发在哪里,该期待什么

有声同人有自己的一套发布习惯,照着来是值得的。AO3 允许把有声同人作为一个作品登记、音频放在别处再链过去;音频本身通常放在通用网盘或播客源上。真正被听见的地方是 Tumblr 和 Discord 服务器,偶尔某个 Reddit 圈子帖能把它带得比这些都远。

预期受众比文字版小,但更死忠。有声同人的听众倾向于追特定 CP 和特定制作者,而不是随便浏览,这意味着打准标签比堆量更重要。一章标签准确、发在圈子本来聊天的地方,胜过十章发进无人区。

简介要写全:圈子、CP、时长多少分钟、声音是否为 AI 生成,以及带链接的原作者署名。时长分钟数是人们真正据以决定听不听的那一栏,而几乎没人写。

要花多少钱

Free

$0 / 月

够你做完一场短戏,听听自己的剧本配上音色是什么样。

  • 每月 10,000 字符——额度每月重置,不是一次性试用
  • 每个项目 2 个角色
  • 5 分钟成片
  • 导出带一段很短的 CastDub 水印
免费开始

Studio

$29 / 月

给连载类的活儿:长篇有声剧、有声书、配音流水线。

  • 每个项目角色数不限
  • 每月 200 分钟成片
  • 逐句情绪控制
  • 多轨与分轨导出(每个角色一条 WAV)
  • 3 个声音克隆槽位
选择此套餐

Team

$69 / 月

给编剧、导演和剪辑一起碰同一个项目的工作室。

  • 5 个席位,项目与角色卡共享
  • 每月 500 分钟成片
  • 10 个声音克隆槽位
  • 优先渲染队列
选择此套餐

完整对比 →

常见问题

这合法吗?

同人文处在一块被默许的灰色地带,宽严程度取决于版权方,转成音频并不改变它的法律地位。真正变了的是曝光度:音频和视频版本传得比文字远,也更招注意。非商用、明显属于二次创作、且所在圈子本就默许——这是已经成形的惯例;出问题的地方基本都出在拿它赚钱。

能克隆原作演员的声音吗?

不能。这是这一页最常见的请求,答案是绝对的。克隆演过某个角色的演员,既是形象权问题也违反我们的政策,而且是让有声同人被下架最快的一条路。换一个音区相近的音色就好——合法、有效,也没人会介意。

怎么取得原作者授权?

如果你在做别人文的有声版,去问。很多作者在个人资料里写了「允许二次创作」的通则;没写的话,发一条简短消息是圈内的基本礼貌,而且几乎都会得到回复。发布时把作者署名放在显眼位置。

涉及成人内容怎么办?

成年角色之间的成人向内容在我们的条款范围内。涉及被设定为未成年角色的性内容不在范围内,无论原作设定或所谓年龄如何;生成这类内容的账号会被关闭。

一章要多久?

渲染很快。真正花时间的是核对说话人归属和听成品。四千字一章,第一次大概需要半小时的专注时间,角色卡建好之后会少得多。

长篇该选哪个套餐?

每章几千字的单篇项目,Creator 基本够用。十万字、摊几个月做的长篇,建议 Studio,为的是更多时长和不限角色数。

今晚就给第一场戏配上音

粘贴剧本,让 CastDub 给每个角色配一个音色,直接导出一部完整的有声剧。

免费开始创作

无需绑卡。免费套餐额度每月重置。