Категория голосов

Генератор голоса для аудиокниги

Одноголосая аудиокнига — стандарт не потому, что слушатели её предпочитают, а потому, что полный состав дорог. CastDub позволяет одному человеку выпустить версию с настоящим составом — рассказчик на авторский текст, отдельный голос каждому персонажу — из той же рукописи, которая уже лежит на столе.

Четыре голоса для начала

Пока готовится публичное демо, примеры звучания — заглушки. Каждый голос доступен на любом тарифе: библиотека не платная стена.

Почему многоголосые аудиокниги редки и любимы

Слушатели стабильно оценивают постановки с полным составом выше одноголосых, а издатели выпускают их редко, потому что состав умножает студийное время, согласование и деньги. Стандартом одноголосую начитку делает экономика, а не предпочтение. Любой самостоятельный автор, который хоть раз считал стоимость постановки, знает, как быстро эти цифры перестают сходиться.

Генерация исполнения меняет само ограничение. Состав стоит столько же, сколько один рассказчик, поэтому решение становится чисто редакторским: выигрывает ли эта книга от раздельных голосов? Для прозы, где много диалога, ответ почти всегда да, а для фэнтезийного ансамбля — тем более: удерживать восьмерых персонажей на слух и есть то, на что читатели жалуются.

Что по-прежнему требует настоящей работы

Основные усилия съедают три вещи. Проход по произношению, неизбежный в любой книге с выдуманной лексикой или необычными именами, — а в русском ещё и с ударениями, которые движок ставит наугад. Подбор, который стоит делать медленно, потому что неверный рассказчик отравляет всю постановку. И прослушивание — настоящее прослушивание каждой главы на нормальной скорости, тот самый шаг, который пропускают и о котором потом жалеют.

По-настоящему исчез цикл записи и перезаписи. Исправить опечатку в девятой главе раньше означало вызвать чтеца на смену; теперь это перерендеренная реплика. Именно это изменение и сделало самостоятельно выпущенные аудиокниги посильными для тех, кто не является профессионалом звука.

Дисциплина на уровне главы

Считайте главу атомарной единицей для всего: рендера, проверки, версий и правок. Ведите простой журнал, какая глава на какой стадии, потому что на книге в сорок глав состояние действительно не держится в голове, а найдут слушатели именно ту главу, которую вы не проверили.

Распределение ролей должно быть одинаковым во всех главах, а персонажи из проекта одной главы в проект следующей не переносятся. Поэтому ведите лист ролей — персонаж из библиотеки, характер и эмоция по умолчанию для каждого, — добавляйте персонажей каждый раз в одном и том же порядке и перед экспортом слушайте первую реплику рассказчика: тогда тридцать первая глава совпадёт со второй без чьих-либо воспоминаний о том, что было выбрано весной.

Раскрытие и ожидания слушателя

Позиция рынка по синтетической начитке меняется быстро, и единственная безопасная поза — прозрачность. Маркируйте. Пишите это в описании, а не только в метаданных. Те, кого синтетическая начитка устраивает, купят всё равно; те, кого не устраивает, узнали бы об этом на первой главе.

Есть и ремесленный аргумент за раскрытие. Оно задаёт верное ожидание, и слушатель, который знает, что слышит, судит это по правильной мерке — чёткая, ровная, хорошо распределённая по ролям читка, — а не по той, на которую запись и не претендовала.

Структура, по которой слушатель может ориентироваться

Читающий бумажную книгу ориентируется глазами: он видит разрыв главы, разрыв сцены, смену точки зрения. У слушателя нет ничего из этого, поэтому структуру приходится нести звуком. Заголовок главы отдельной репликой с настоящей паузой после. Более длинный промежуток на разрыве сцены. Единый способ сигналить смену точки зрения — в постановке с составом это может быть просто смена рассказчика.

Отдельно подумайте о том, что стоит в начале. Длинные посвящения, эпиграфы и благодарности в начале аудиокниги — то место, где слушатели уходят, потому что им ещё не за что держаться. Большинство аудиоизданий переносит их в конец, и то же стоит сделать со всем, что не является самой историей.

От сценария к аудио за несколько шагов

  1. Разбейте рукопись по главам

    Работайте теми кусками, которыми будете публиковать. Глава — правильный размер и для пересборки после правки, и для проверки за один сеанс прослушивания.

  2. Сначала подберите рассказчика

    На рассказчике держится большая часть хронометража. Прослушивайте на самом плотном абзаце и слушайте три полные минуты, прежде чем решать.

  3. Дайте найти диалоги

    Авторазбор находит прямую речь и атрибуцию в прозе, поэтому «сказала она» превращается в назначение персонажу. В русском тексте это реплики с тире; поправьте те, что распознались неверно, и правка сохранится.

  4. Сделайте проход по произношению

    Соберите все имена, топонимы и выдуманные слова и проверьте, как звучит каждое. Отдельной настройки произношения нет, поэтому упрямые слова перепишите в рукописи — другим написанием или через дефис — и держите этот список для каждой главы. Двадцать минут здесь экономят пересборку поздних глав.

  5. Отрендерите и соберите

    Заведите на каждую главу свой проект и выгрузите её отдельным файлом, а при желании и субтитры (начиная с Plus) для синхронного текстового издания. Сведение под требования площадки делайте в конце.

Частые вопросы

Можно ли продавать аудиокнигу, начитанную ИИ?

Коммерческие права на сгенерированное аудио идут с любым платным тарифом. Принимает ли синтетическую начитку конкретная площадка — отдельный вопрос с меняющимся ответом: часть крупных сервисов принимает при раскрытии, часть нет. Уточните текущую политику вашего дистрибьютора до того, как отрендерите сорок часов.

Обязательно ли сообщать, что читает ИИ?

Всё чаще обязательно, и сообщать стоит в любом случае. Большинство площадок, допускающих синтетическую начитку, требуют её маркировать, а слушатели, узнавшие об этом после покупки, оставляют ровно те отзывы, которых вы ожидаете.

Правда ли у каждого персонажа будет свой голос?

В этом весь смысл инструмента. В обычной аудиокниге один чтец играет всех; здесь каждый персонаж — действительно другой голос, и длинные диалоговые сцены становятся заметно легче для слуха.

Сколько времени занимает роман?

Рендер быстрый; работа — это подбор, проход по произношению и прослушивание. На типичный роман закладывайте день-два настоящих усилий, большая часть которых уходит на проверку, а не на генерацию.

Что делать со сносками, заголовками и предисловием?

Отдавайте им отдельные реплики с осознанными паузами. Особенно рассыпается нон-фикшн, когда заголовок вливается в основной текст: слушатель теряет структуру, которую на бумаге увидел бы глазами.

Какой тариф нужен?

Plus — ради минут: 200 минут в месяц это примерно три-четыре часа готового аудио, и на нём же появляется экспорт SRT для синхронного текстового издания. Одну неверно прочитанную реплику можно перегенерировать отдельно, не пересобирая главу, но повторный экспорт главы снова посчитает все её знаки.

Что люди делают с этими голосами

Озвучьте первую сцену уже сегодня

Вставьте сценарий, дайте CastDub подобрать голос каждому персонажу и экспортируйте готовый аудиоспектакль.

Создать бесплатно

Карта не нужна. Free даёт разовый запас кредитов.