声のカテゴリー

ポッドキャスト音声ジェネレーター

台本のあるポッドキャストは、合成音声がいちばん向いている形式です。あらかじめ書かれていて、音声だけで消費されて、たいていスタジオを持たない1人か2人が作っています。パーソナリティをキャスティングして、ゲスト役をキャスティングして、1話ぶんを書き出してください。

まずはこの4人から

Hale

Hale

ドキュメンタリー部分のナレーター

落ち着きドキュメンタリー
Indie

Indie

速く、平板で、うっすら面白がっている

カジュアル早口

公開用のデモ音声を制作中のため、サンプルは仮の音声です。どのプランでもすべての声を使えます。ライブラリは有料の壁ではありません。

台本のある形式がいちばん向いています

ポッドキャストは大きく2つに分かれます。台本なしで2人が話す会話型と、全部の言葉があらかじめ書かれている台本型です。合成音声は前者にはほとんど役に立たず、後者には本当によく効きます。台本のある番組はすでに「書かれたテキストの上演」であって、それはまさにこの種のツールがやっていることだからです。

台本型の中でも、物語のフィクションとドキュメンタリー調の語りがいちばん相性が良い。どちらも構造を保つナレーターがいて、その中に登場人物や証言者が現れる形をしていて、それはキャスティングして書き出す作業にそのまま写ります。

書かれたように聞こえないセリフの書き方

書き起こされた話し言葉と、書かれたセリフの違いは紙の上で見えます。本物の話し言葉には言い直し、繰り返し、フィラー、途中で終わる文があります。書かれたセリフは整っています。整った台本が上演されると、上演のように聞こえます。ドラマならそれでよく、会話型のポッドキャストでは間違いです。

直し方は、整っていなさを書き込むことです。「いや、その、なんていうか」を紙に書く。相方に短い合いの手を独立した行で与える。文を早めに終わらせて、もう片方に続きを言わせる。どれも機能を必要としません。書くと決めるだけです。

注意を保つ構造

ポッドキャストの視聴データは、プラットフォームをまたいで一貫しています。いちばん大きな離脱は最初の90秒と、コーナーの境目で起きます。ここから構造上の習慣が2つ出てきます。長いブランドのオープニングではなく内容から始めること。そして、すべての切り替わりに仕事をさせること。問い、引き、あるいは声の交代です。

声の交代は注意を引く道具として過小評価されています。パーソナリティからナレーターに切り替わる、新しい登場人物が出てくる。これは、1つの声の中でどれだけ熱量を上げても届かない仕方で注意をリセットします。キャストがあるということは、コーナーの境目ごとにそのレバーがあるということです。

もう一度、開示について

ポッドキャストの聴き手はパーソナリティに対して珍しく強く結びついていて、だからこそ、開示されていない合成パーソナリティが見つかったときの反応は悪くなります。番組概要欄に1行入れてください。費用はゼロで、話題が「だまし」から「作り」に変わります。

絶対的な限界がひとつ。実在の特定できる人物の声に似た音声を作って、その人として提示しないこと。意図にかかわらずなりすましですし、番組とアカウントの両方をいちばん速く失う道です。

冒頭の30秒が1話ぶんを稼ぐ

ポッドキャストの分析結果は容赦なく一貫しています。単独でいちばん大きい離脱は最初の90秒に起き、話の頭に置かれた長いブランドのオープニングは、それを引き起こすいちばん確実な方法です。聴き手を残す構造は、内容が先——その回でいちばん面白いところを30秒——それからオープニング、それから本編です。

これは録音された番組より、生成された番組でいっそう重要になります。合成音声には、人のパーソナリティが数秒ぶんの好意を稼いでいる、あの付随的な温かみが少ないからです。人柄ではなく、書いたもので注意を勝ち取る必要があります。

下敷きの音楽に対してセリフを混ぜる

生成されたセリフはきれいで均一に届きます。利点に聞こえますし、実際そうなのですが、ひとつだけ特有の問題を作ります。音楽の中に座らず、上に乗ってしまうのです。直し方は放送が何十年も使ってきたものと同じで、話しているあいだ音楽を下げること、そしてセリフの下にごく少量の部屋の音を足して、浮かずに場所を占めるようにすることです。

どちらも1度決めればテンプレートとして保存できる判断です。設定してしまえば、以降の全話が考えずに正しく座ります。1度だけ解く価値のある種類の問題です。

数ステップで台本から音声まで

  1. エッセイではなく会話として書く

    2人のポッドキャストは、割り込みと相づちと途中で終わる文のある会話です。エッセイを2つの声に割ったものは、まさにそう聞こえます。

  2. 分離のためにキャスティングする

    パーソナリティは1文のうちに聞き分けられなければいけません。聴き手には顔が見えないからです。音高の帯と話す速さを別々にしてください。

  3. コーナーごとに組む

    冒頭、オープニング、本編、締め。作り直されるのは変えた行だけなので、頭を触らずに真ん中を直せます。コーナーを別々のファイルにしたいなら、コーナーごとにプロジェクトを分けてください。

  4. 熱量の曲線を演出する

    ポッドキャストの注意は着実に落ちます。いちばん熱量の高い読みは、聴き手が続けるかどうかを決めるコーナーの切り替わりに置いてください。

  5. トラックを書き出して音楽と混ぜる

    Proで声ごとのトラックを取れば、テーマ曲やジングルや下敷きの音楽が、ミックス済みのファイルと戦うのではなく、ちゃんと下に座れます。

よくあるご質問

合成音声だと聴き手に気づかれますか。

気づく人はいます。とくにフリートークに見せかけた形式では、仕上がりの良さが手がかりになります。物語系やドキュメンタリー系はずっと隠れます。聴き手が台本のある読みを期待しているからです。番組概要欄で開示するのは正直ですし、私たちの経験では、あとから見つかるよりずっと傷が浅く済みます。

会話っぽくできますか。

大半は書き方でやります。話し言葉の縮約、言い直しを文字として書くこと、短い割り込み、そして相づちを独立した行にすること。どの設定よりも効きます。整いすぎたエッセイ問題は、声の問題ではなく台本の問題です。

日本語で会話っぽくするには具体的に何を書きますか。

相づちです。日本語の会話は英語よりあいづちの頻度が高く、「うん」「なるほど」「へえ」が0.5秒おきに入ります。これを独立した行として書くだけで、それらしさが跳ね上がります。もうひとつは終助詞で、「〜だよね」「〜じゃないですか」を書き分けると、2人の距離感が音になります。全部を「です・ます」で揃えると、途端に朗読になります。

自分の声と生成した声を混ぜられますか。

音声編集ソフトの上でなら混ぜられますし、よくある構成です。自分がパーソナリティをやって、相方や資料の中の人物を生成する。似たレベルで、それなりに響きの少ない部屋で録れば、2つは問題なく並びます。

インタビュー番組はどうですか。

実在の人物との偽のインタビューを作るのは認められませんし、規約で禁じています。架空の人物とのインタビューや、そうと明示された歴史の再現ドラマは問題ありません。

1話はどれくらいの長さにできますか。

1話の長さは1回の書き出しの上限ではなく、毎月のクレジットで決まります。クレジットは台本の文字数で、書き出すたびに数えます。有料プランは毎月リセットされ、日本語ならBasicはおよそ160分。週1回15分の番組でも余裕があります。Plusのおよそ540分なら、たいていの週刊形式が収まります。Freeのおよそ13分は一度きりの体験ぶんなので、番組を回すためのものではありません。

今夜、最初の1シーンをキャスティング

台本を貼り付ければ、CastDubが登場人物一人ひとりに声を割り当てます。あとは完成したボイスドラマを書き出すだけです。

無料で作ってみる

クレジットカードは不要です。無料枠は一度きりの持ち分です。