Мы подключили Fish Audio S2.1 Pro — и вместе с ним в каталог приехали 1 442 новых голоса. Всего в библиотеке теперь 1 478 голосов, и больше тысячи двухсот из них говорят по-русски. Заодно студия озвучки научилась нескольким вещам, которых там не было.
Персонажи, блогеры, дикторы
Это не безымянные «Голос №14» и «Женский 3». В каталоге — Крош, Копатыч, Диппер, Винни-Пух, Рик Санчез, Патрик, Скаут из Team Fortress 2, Желейный медведь Валера, Доктор Гнус, Меллстрой, Дмитрий Нагиев — и дальше по списку. Плюс то, что нужно для работы: дикторы файтингов и аркад, рассказчики для хорроров, спокойные женские голоса для медитаций, гул стадиона фоном.
Почти у каждого — своя обложка и записанный образец, который можно послушать до того, как потратите кредиты. Есть поиск, фильтры по языку, полу, возрасту и манере, и сортировка по популярности.
Эмоции ставятся прямо в текст
Главное отличие новой озвучки от «робота, читающего абзац» — маркеры эмоций. Это ремарки в квадратных скобках: движок их исполняет, но вслух не произносит.
> [narrating] Город спал. [pause] Лишь одно окно на верхнем этаже ещё горело.
Шёпот, крик, смех, вздох, дрожь в голосе, пауза, ускорение — 66 маркеров, разложенных по группам: чувства, подача, окраска голоса, реакции, темп. Открываете палитру, выбираете нужный, и он встаёт туда, где стоял курсор. В поле маркеры подсвечиваются, чтобы ремарка не сливалась с репликой, а несуществующий маркер помечается красным — иначе движок прочитал бы его вслух.
Не хотите расставлять руками — нажмите «Авторазметка», и ИИ прочитает ваш текст и расставит эмоции сам. Результат можно отменить одной кнопкой, если разметка не понравилась.
Диалог на восемь голосов
Одна озвучка больше не равна одному голосу. Добавляйте блоки — до восьми говорящих, у каждого свой голос и своя реплика. Сцена собирается целиком за один запуск, и её не нужно потом склеивать в редакторе.
Клон своего голоса за 30 секунд
Загрузите сэмпл до 30 секунд — mp3, wav или ogg, подойдёт даже голосовое из мессенджера — и получите цифровую копию голоса, готовую озвучить любой текст. Клон сохраняет тембр и манеру и остаётся в вашей библиотеке.
Скорость, громкость, нормализация
В композере появились регулировки скорости и громкости, а также нормализация текста — числа, даты и сокращения читаются так, как их произнёс бы человек, а не по символам.
Послушать можно, не заходя в приложение
И последнее: библиотека переехала на главную страницу. Там же можно выбрать голос, услышать его образец, написать реплику и расставить эмоции — без регистрации. Кнопка «Озвучить» откроет студию с вашим текстом и выбранным голосом уже на месте.
Послушайте библиотеку
Выберите голос, напишите реплику и поставьте в неё эмоцию — это займёт полминуты.