Цены в кредитах
Сколько стоит одна генерация в каждой модели на Fyro. Укажите свой баланс — на карточках появится, на сколько его хватит.
Видео 18
Генерация видео из текста, анимация изображений и редактирование видео.
Флагман ByteDance: до 30 секунд одним дублем со звуком, до 30 изображений-референсов, референс-видео и связный сюжет без склеек.
Видео-модель нового поколения от ByteDance — со звуком, длительностью до 15 секунд, мульти-референсами и референс-видео.
Мини-версия Seedance 2.0 — высокая скорость и качество при самой низкой цене в линейке.
Последняя передовая модель генерации видео от Google DeepMind. Текст-в-видео, картинка-в-видео, первый и последний кадр, референсы.
Быстрая и экономичная версия Google Veo 3.1. Текст-в-видео, картинка-в-видео, первый и последний кадр, референсы.
Kling O3 Pro — видеомодель с анимацией начального/конечного кадра, нативным аудио, управлением голосом и выводом 1080p.
Kling O3 Standard — доступная видеомодель с анимацией кадров, нативным аудио и управлением стилем.
Новейшая флагманская видеомодель от Kuaishou — Kling 3.0 Pro с улучшенной физикой движения, кинематографическим качеством и нативной генерацией аудио.
Быстрая и доступная видеомодель Kling 3.0 Standard с качественной генерацией видео и поддержкой аудио.
Перенос движения из видео на персонажа с изображения. Kling 3.0, профессиональное качество.
Перенос движения из видео на персонажа с изображения. Kling 3.0, улучшенное качество.
Быстрая и доступная видеомодель от Google — текст в видео и изображение в видео с нативным аудио, до 1080p.
Видео с синхронным звуком от Google: текст-в-видео, оживление картинки, переход между первым и последним кадром и до 10 референсов. Горизонталь и вертикаль, длительность 3–10 секунд, черновик 360p для подбора кадра и финал в 1080p или 4K.
Редактирование готового видео текстовой командой с сохранением сцены — без полной перегенерации. Ролик до 10 секунд, результат в 360p, 720p, 1080p или 4K.
Фронтирная видеомодель MiniMax: 768p/2K, нативное стерео-аудио с репликами и шумами, длительность 5–15 секунд. Текст-в-видео, оживление картинки, переход между первым и последним кадром и до 5 референсов.
Быстрая версия MiniMax H3, дотренированная fal: 480p/768p, нативный звук с репликами и шумами, длительность 5–15 секунд, дубль готов за секунды. Текст-в-видео, оживление картинки, переход между первым и последним кадром и до 4 референсов.
Видеомодель №1 от Alibaba, версия 1.1. 1080p видео с нативным звуком и многоязычным lip-sync. Три режима: текст-в-видео, оживление картинки и до 9 персонажей-референсов. Длительность 3–15 секунд.
Изображения 14
Новое поколение картинок OpenAI: Flare отвечает вдвое быстрее GPT Image 2, Sunburst даёт лучшее качество и самые точные правки.
Второе поколение генератора изображений xAI — точнее следует запросу и держит текст на картинке; принимает до 5 референсов.
Модель генерации изображений — создаёт высококачественные детальные изображения по текстовым запросам.
Флагманская модель генерации изображений от Recraft — V4.1 с фотореалистичным качеством и точной передачей текста.
Профессиональная версия Recraft V4.1 — максимальное качество генерации изображений с улучшенной детализацией, до 2048×2048.
Новейшая модель генерации изображений от Google на базе Gemini 3.1. Поддерживает reasoning, web search, точный текст на изображениях и разрешение до 4K.
Новая современная модель генерации и редактирования изображений от Google
Лёгкая версия Nano Banana 2: генерация и правки за ~1 секунду, фиксированное разрешение 1K.
Идеальна для высококачественной обработки изображений, переноса стилей и последовательных рабочих процессов редактирования
Флагманская модель генерации изображений ByteDance: глубокое понимание промпта, нативный текст на 14 языках, точная работа с плотными макетами. Редактирование до 10 референсов.
Быстрая и качественная модель генерации изображений от ByteDance. Seedream 5.0 Lite поддерживает интеллектуальную генерацию изображений по тексту и редактирование с несколькими входными изображениями.
Нативные 4K, аккуратная вёрстка кадра и лучший в семействе рендеринг текста, включая кириллицу. Понимает инструкции по правкам и до шести референсов.
Премиум ИИ-апскейлер — увеличивает разрешение до 200x с сохранением деталей лиц, текстур и мелких элементов
Удаление фона с помощью ИИ — создаёт чистые прозрачные PNG с точным определением краёв
Чат 16
Новая флагманская модель OpenAI для сложного кода, анализа и многошаговых задач. Доступна на тарифе «Продвинутый».
Флагман семейства GPT-5.6: максимальный интеллект OpenAI, контекст 1М токенов.
Сбалансированная модель GPT-5.6: интеллект флагмана прошлого поколения при вдвое меньшей цене.
Самая быстрая и экономичная модель семейства GPT-5.6.
Новейшая модель Anthropic: уровень Opus в агентных задачах и кодинге по цене Sonnet.
Самая быстрая и интеллектуальная модель Claude Haiku
Флагман Anthropic для сложных проектов, документов и программирования. Доступен на тарифе «Продвинутый».
Флагман Anthropic: лучший результат в агентных задачах, длинных цепочках рассуждений и сложном коде. Контекст 1 млн токенов, мышление до уровня «максимум».
Новейшая модель xAI: самая умная и быстрая в линейке Grok. Адаптивное рассуждение, контекст 500k, понимает изображения, знания по февраль 2026.
Новая модель DeepSeek для текста, кода и анализа изображений. Контекст 1M токенов, настраиваемые рассуждения и инструменты чата.
Флагманская мультимодальная модель Moonshot AI (2.8T параметров) со встроенными рассуждениями и контекстом 1M токенов. Очень сильна в сложном коде, знаниях и длинных агентных сценариях.
GLM-5.3 Flash для текста, кода и изображений. Рассуждения и инструменты чата по доступной цене.
GLM-5.3 для текста, кода и анализа. Настраиваемые рассуждения и инструменты чата.
Флагман Alibaba Qwen: гибридные рассуждения с настройкой глубины, понимание изображений и видео, контекст 1M токенов. Уверенно конкурирует с закрытыми фронтир-моделями по кодингу и анализу.
Qwen3.8 Flash для текста, кода и изображений. Настраиваемые рассуждения и инструменты чата по доступной цене.
Быстрая модель Google для текста, кода и работы с изображениями. Поддерживает рассуждения и инструменты.
Аудио 7
Распознавание речи OpenAI: текст записей и голосовых сообщений
Универсальная модель распознавания речи
Модель преобразования текста в речь, оптимизированная для скорости
Модель преобразования текста в речь, оптимизированная для качества
Grok TTS от xAI — 5 выразительных голосов с автоопределением языка (20+ языков)
Флагманская TTS Fish Audio: инлайн-теги эмоций, многоголосые диалоги, нативный русский.
Универсальная аудио-модель ByteDance: озвучка с естественной интонацией, клонирование голоса по короткому образцу, многоголосые диалоги, фоновые шумы и музыка.
Нужны кредиты?
Кредиты входят в каждый тариф — чем больше пакет, тем дешевле каждый кредит.
Смотреть тарифыМодели из расчёта кириллицы тарифицируются по байтам UTF-8: русский символ занимает два байта, латинский — один, поэтому тот же текст на латинице обойдётся примерно вдвое дешевле. Цены на изображения и видео — оценка для настроек по умолчанию: длительность, разрешение и качество меняют стоимость, а перед запуском генерации вы видите расчёт под выбранные вами параметры. Чат тарифицируется по токенам: 1 000 токенов — это примерно 750 слов; запрос и ответ оплачиваются по своим ставкам.