В Fyro появилась Seed Audio 1.0 — модель озвучки от ByteDance. Она умеет то, чего не умела ни одна из наших прежних аудиомоделей: клонировать голос по короткому сэмплу и собирать целые звуковые сцены.

Клон голоса за 30 секунд

Загрузите аудиосэмпл длиной до 30 секунд — и получите цифровую копию голоса, которой можно озвучить любой текст. Не нужны студия, долгие записи и обучение модели.

  • Форматы mp3, wav и ogg — подойдёт даже голосовое из мессенджера.
  • Клон сохраняет тембр, манеру и интонации оригинала.
  • Русская речь звучит естественно. В наших тестах расшифровка синтезированной речи дословно совпадала с исходным текстом.

Звук из текста

Режим «Звук из текста» создаёт не только речь, а целую сцену:

  • диалоги нескольких персонажей с разными голосами;
  • звуковые эффекты — шаги, дождь, городской шум, техника;
  • музыкальные фрагменты и атмосферный фон.
Промпт «Ведущий бодро объявляет прогноз погоды, на фоне звенит трамвай» даёт готовую сцену целиком.

Настройка и цена

У голосов Seed Audio есть регулировки скорости (0,5–2×) и тона (±12 полутонов) прямо в композере. Оплата — посекундная: только за длительность готового аудио, а не за количество символов.

Озвучка в чате

Попросите ИИ в чате озвучить текст или собрать звуковую сцену. Аудио появится прямо в диалоге — с плеером и кнопкой «Открыть в студии озвучки».

Доступность

Seed Audio 1.0 доступна в студии озвучки Fyro и в чате.