В Fyro появилась Seed Audio 1.0 — модель озвучки от ByteDance. Она умеет то, чего не умела ни одна из наших прежних аудиомоделей: клонировать голос по короткому сэмплу и собирать целые звуковые сцены.
Клон голоса за 30 секунд
Загрузите аудиосэмпл длиной до 30 секунд — и получите цифровую копию голоса, которой можно озвучить любой текст. Не нужны студия, долгие записи и обучение модели.
- Форматы mp3, wav и ogg — подойдёт даже голосовое из мессенджера.
- Клон сохраняет тембр, манеру и интонации оригинала.
- Русская речь звучит естественно. В наших тестах расшифровка синтезированной речи дословно совпадала с исходным текстом.
Звук из текста
Режим «Звук из текста» создаёт не только речь, а целую сцену:
- диалоги нескольких персонажей с разными голосами;
- звуковые эффекты — шаги, дождь, городской шум, техника;
- музыкальные фрагменты и атмосферный фон.
Настройка и цена
У голосов Seed Audio есть регулировки скорости (0,5–2×) и тона (±12 полутонов) прямо в композере. Оплата — посекундная: только за длительность готового аудио, а не за количество символов.
Озвучка в чате
Попросите ИИ в чате озвучить текст или собрать звуковую сцену. Аудио появится прямо в диалоге — с плеером и кнопкой «Открыть в студии озвучки».
Доступность
Seed Audio 1.0 доступна в студии озвучки Fyro и в чате.