
Indie
快、平、带一点点戏谑
短视频的信息流是一场连续不断的试镜。观众在一秒之内就决定要不要继续看,通常在画面还没真正被看清之前,这就把异常大的分量压在了最开头那个声音上。氛围式的开场、慢慢铺起来的前奏、带品牌的转场音效,代价都是你本来想吸引的那批观众。
实际做法是把第一句写成一个完整、能自我成立的钩子,并且单独渲出来检查。如果它要等到第二句才成立,那它就是不成立。
大多数短视频是在手机喇叭上、以中等音量、常常在嘈杂环境里被看的。那种喇叭几百赫兹以下几乎什么都放不出来,也就是说低沉、温厚、电影感的整套审美,对这批观众来说根本不存在。
真正管用的是中频靠前、咬字清楚的音色——也就是在监听耳机上可能显得有点薄的那些。这是少数几种「用差设备试听才是正确方法」的情形之一。
小剧场、反应类形式和演绎式对话在短视频里一贯比纯解说表现更好,而它们恰恰是单音色工具做不出来的东西。把一来一回两边都写出来、分别配上,只多花几分钟,却改变了你能做什么类型的内容。
它对节奏也有帮助。两个声音之间的切换,和一次画面剪切带来的注意力重置是一样的,而短视频观众已经被训练成预期每隔几秒就有变化。
很大一部分短视频播放是从静音开始的,而且相当一部分一直静音。所以硬字幕不是无障碍的锦上添花,而是你脚本的主要投递通道。
从脚本生成字幕而不是从音频转写,意味着人名、俚语和产品名的拼写是对的,而自动字幕恰恰在这里稳定失手。从渲染里取时间轴文件,用你剪辑软件喜欢的字号压进去就行。
短视频平台衡量的是观众有没有看完第一遍循环,而留住他们的可靠办法是变化——新的镜头、新的想法、新的声音。这三者里,新的声音是最便宜、也最少被用的,因为多数创作者只有一个。
一段双角色的来回,哪怕只有四句,也能在一个单解说本来会掉人的位置重置注意力。这就是反应类形式和演绎式对话在这个格式里一贯超过纯解说的原因,而它是结构性优势,不是风格偏好。
六十秒在偏快的语速下大约是 160 个口语词。这是一段话,不是一篇文章,而短视频写作最常见的失败就是想靠说得更快把一个长内容塞进去。
说得更快不会增加信息;过了某个点它反而减少信息,因为听众停止解析了。正确的动作是把这个想法削到装得下的那一件事,而这几乎总会让片子既更短也更好。
一个好用的纪律:写完稿子,数词数,如果一条六十秒的片子超过 160 词,就删,不要加速。语速参数应该是你最后才碰的东西,不是第一个。
第一句要当成唯一会被听到的一句来写,因为对多数观众来说它就是。然后单独渲这一句,确认它冷起手也立得住。
手机喇叭几乎放不出低频。明亮、中频靠前的音色能穿出来,低沉的氛围音色会整个消失。
短视频的语速比常规叙述快。把语速往上推到辅音开始糊掉,然后退回一档。
双角色小剧场是表现最好的短视频形式之一,而在这里做起来轻而易举——两边都写,两边都配,一次渲完。
大部分短视频的观看一开始是静音的。用同一份脚本生成的硬字幕不容商量,而且它已经是对齐的。
不能,任何人都无法正当地做到——那个声音属于平台,克隆它既违反那里的条款,也违反我们这边的政策。你可以做的是挑一个音区相近的明亮、快速、中性音色,而真正让那种风格成立的就是这个音区。
不会因为它是合成的。短视频平台降权的是重复、低投入的内容和未标注来源的搬运。一个原创脚本配上生成音色,不属于这一类。
因为你大概是戴着耳机挑了个低沉的音色。手机喇叭把低频全滚掉了,所以请用手机喇叭试听——那是你听众在用的设备,而且它毫不留情。
快到你听不出词与词的边界就算。实用测试是放一遍,试着把听到的话写下来。如果你写不出来,一个同时还在读字幕的观众也写不出来。
这是最好的用法之一。讲故事本来就对白密集,把故事里的其他人配成不同音色,比一个解说员包演所有人好跟太多。
Creator 能覆盖多数每日短视频节奏——每月六十分钟能装下非常多条三十秒的片子。如果你开始做多角色系列,就升到 Studio。