
Nova
Корабельный ИИ, прочитавший ваше досье
Категория голосов
Интересные голоса роботов — не те, что жужжат. Интересны те, что почти человеческие и неправильны в одной мелочи: идеальная ровность, отсутствие дыхания, пауза не в том месте. Это решение об исполнении, и им можно управлять.

Nova
Корабельный ИИ, прочитавший ваше досье

Halcyon
Спокоен до состояния тревожности

Noor
Чёткость системы оповещения

Vex
Нечто, надевшее разумный тон
Пока готовится публичное демо, примеры звучания — заглушки. Каждый голос доступен на любом тарифе: библиотека не платная стена.
Первый — ретрокомпьютер: тяжело обработанный, слоговой, откровенно механический. Это скорее сигнал ностальгии, чем персонаж, и делается он целиком эффектами, а не исполнением. Второй — современный помощник: приятный, ровный, чуть тёплый, неотличимый от хорошего коммерческого синтеза речи, — чем он, собственно, и является. Третий — андроид: полностью человеческий по тембру и едва заметно нечеловеческий по поведению.
Решением о подборе является по-настоящему только третий, и именно на него стоит тратить время, потому что только он способен вытянуть драматическую сцену. Первые два — реквизит, а реквизит дёшев.
В английском машинность сигналят отказом от стяжённых форм. В русском стяжений нет, и признак приходится строить иначе — по тому, чего в речи не хватает. Убирается весь разговорный слой: частицы «ну», «же», «вот», «как бы», вводные «слушай» и «короче», уменьшительные, обращения по имени. Убираются оборванные и неполные предложения: человек говорит «Сейчас», машина говорит «Выполняю»; человек говорит «Да не то чтобы», машина отвечает утверждением или отрицанием.
Дальше идёт точность. Там, где человек округлит — «минут через пять», — машина назовёт «через четыре минуты десять секунд». Там, где человек скажет «много», машина назовёт число. И наконец, канцелярская лексика: отглагольные существительные и страдательный залог, которые в живой речи звучат мертво, здесь работают на вас: «Осуществляется проверка» вместо «Я проверяю».
Второй инструмент — несовпадение реплик. Человек говорит что-то эмоциональное, машина отвечает информацией. Этот обмен устанавливает нечеловечность быстрее любой обработки и переживает перевод, сжатие и плохие динамики.
Каждый запечённый эффект — решение, к которому нельзя вернуться. Кольцевая модуляция, идеально звучавшая на ваших мониторах, окажется неразборчивой на телефоне. Удвоенный голос, работавший в тихой сцене, будет драться с музыкой в громкой. А если потом понадобится поменять одно слово, новый рендер не совпадёт с обработанным оригиналом.
Генерация чистого аудио и обработка в редакторе стоят нескольких минут и оставляют открытым каждое из этих решений. Экспорт по дорожкам во многом существует именно ради этого.
В том, чтобы синтетическим голосом играть синтетический голос, есть что-то по-настоящему смешное, и это стоит проговорить вслух: голос современного помощника получается здесь легко именно потому, что это та же самая технология без изменений. Тревожный андроид труднее, потому что требует от модели быть достаточно человеческой, чтобы поверили, и достаточно управляемой, чтобы быть неправильной.
На практике это значит, что ретро и помощник достаются почти даром, а время режиссуры должно уходить на андроида. То есть ровно наоборот тому, как его обычно тратят.
Вне фантастики самое продуктивное применение эмоционально ровного голоса — комедия. Неумолимо доброжелательная автоматическая система, объясняющая абсурд; внутримировое объявление, сообщающее о катастрофе тоном табло прибытия; навигатор, у которого появилось мнение, — всё это работает потому, что регистр зафиксирован намертво, а содержание нарастает.
Правило письма здесь одно: машина ни в коем случае не признаёт абсурд. В ту секунду, когда она комментирует происходящее, она становится персонажем с чувством юмора, и шутка сдувается до обычного смешного голоса. Держите подачу нейтральной, лексику — процедурной, а реагировать пусть будет вся остальная сцена.
Вычислительная машина шестидесятых, современный голосовой помощник и тревожный андроид — три разных звука. Первый обработан, второй ровный и приятный, третий человеческий, но чего-то лишённый.
Начинайте с голоса, у которого от природы мало эмоциональной вариативности. Тёплый голос, пропущенный через фильтр, обычно звучит просто тёплым голосом из плохого динамика.
Машинный персонаж узнаётся по тому, чего в его речи нет: ни «ну», ни «же», ни «вот», ни уменьшительных, ни оборванных фраз. Полные формы слов и законченные предложения — самая дешёвая и самая действенная правка на этой странице.
Тревожность машинного голоса рождается из эмоциональной ровности там, где ситуация требует эмоции. Сдержите желание режиссировать.
Выгружайте чистым и накладывайте фильтрацию, удвоение или кольцевую модуляцию в редакторе. Чистый дубль всегда можно испортить, испорченный вернуть нельзя.
Из рендера — нет, и это намеренно. Такой звук — эффект обработки: кольцевая модуляция, вокодер, снижение разрядности, — накладываемый после. Сгенерируйте исполнение чистым и добавьте эффект в редакторе, где его можно убавить, когда выяснится, что слов не разобрать.
Потому что обработанный голос очевидно машина, и слушатель расслабляется. Голос, почти человеческий, но эмоционально отсутствующий, попадает в зловещую долину, и неуютно именно оттого, что его не удаётся отнести ни к одной категории.
Пишите предельно правильными законченными предложениями, держите эмоцию нейтральной и отвечайте на эмоциональные моменты процедурной информацией. Несовпадение содержания и подачи делает всё.
Внутри одного рендера — нет. Сгенерируйте реплики чистыми и наращивайте деградацию на поздних в редакторе. В постобработке заодно настраивается скорость распада, а она с первого раза обычно неверна.
Ещё как. Системы оповещения, телефонные меню, внутриигровая навигация и сатира на корпоративные рассылки живут в одном регистре, а комический потенциал неумолимо доброжелательного автоответчика практически неисчерпаем.
Да, но для доступности нужен самый чёткий голос, а не самый ровный. Фильтруйте по стилевому тегу «чёткий» и проверяйте на ускорении: многие пользователи экранных дикторов слушают заметно быстрее реального времени.
Вставьте сценарий, дайте CastDub подобрать голос каждому персонажу и экспортируйте готовый аудиоспектакль.
Создать бесплатноКарта не нужна. Free даёт разовый запас кредитов.