Pricing in credits
What one generation costs with every model on Fyro. Set your balance — each card shows how far it goes.
Video 17
Генерация видео из текста, анимация изображений и редактирование видео.
Флагман ByteDance: до 30 секунд одним дублем со звуком, до 30 изображений-референсов, референс-видео и связный сюжет без склеек.
Видео-модель нового поколения от ByteDance — со звуком, длительностью до 15 секунд, мульти-референсами и референс-видео.
Мини-версия Seedance 2.0 — высокая скорость и качество при самой низкой цене в линейке.
Последняя передовая модель генерации видео от Google DeepMind. Текст-в-видео, картинка-в-видео, первый и последний кадр, референсы.
Быстрая и экономичная версия Google Veo 3.1. Текст-в-видео, картинка-в-видео, первый и последний кадр, референсы.
Kling O3 Pro — видеомодель с анимацией начального/конечного кадра, нативным аудио, управлением голосом и выводом 1080p.
Kling O3 Standard — доступная видеомодель с анимацией кадров, нативным аудио и управлением стилем.
Новейшая флагманская видеомодель от Kuaishou — Kling 3.0 Pro с улучшенной физикой движения, кинематографическим качеством и нативной генерацией аудио.
Быстрая и доступная видеомодель Kling 3.0 Standard с качественной генерацией видео и поддержкой аудио.
Перенос движения из видео на персонажа с изображения. Профессиональное качество.
Перенос движения из видео на персонажа с изображения. Kling 3.0, улучшенное качество.
Быстрая и доступная видеомодель от Google — текст в видео и изображение в видео с нативным аудио, до 1080p.
Видео с синхронным звуком от Google: текст-в-видео, оживление картинки и референсы. Улучшенная физика движения.
Редактирование готового видео текстовой командой с сохранением сцены — без полной перегенерации.
Фронтирная видеомодель MiniMax: 768p/2K, нативное стерео-аудио с репликами и шумами, длительность 5–15 секунд. Текст-в-видео, оживление картинки, переход между первым и последним кадром и до 5 референсов.
Видеомодель №1 от Alibaba, версия 1.1. 1080p видео с нативным звуком и многоязычным lip-sync. Три режима: текст-в-видео, оживление картинки и до 9 персонажей-референсов. Длительность 3–15 секунд.
Imagine 15
Передовая модель генерации изображений
Новая эра генерации изображений — идеальный текст, фотореализм, многоязычность
Модель генерации изображений — создаёт высококачественные детальные изображения по текстовым запросам.
Модель генерации изображений — создаёт высококачественные детальные изображения по текстовым запросам.
Флагманская модель генерации изображений от Recraft — V4 с фотореалистичным качеством и точной передачей текста.
Профессиональная версия Recraft V4 — максимальное качество генерации изображений с улучшенной детализацией.
Новейшая модель генерации изображений от Google на базе Gemini 3.1. Поддерживает reasoning, web search, точный текст на изображениях и разрешение до 4K.
Новая современная модель генерации и редактирования изображений от Google
Лёгкая версия Nano Banana 2: генерация и правки за ~1 секунду, фиксированное разрешение 1K.
Идеальна для высококачественной обработки изображений, переноса стилей и последовательных рабочих процессов редактирования
Флагманская модель генерации изображений ByteDance: глубокое понимание промпта, нативный текст на 14 языках, точная работа с плотными макетами. Редактирование до 10 референсов.
Быстрая и качественная модель генерации изображений от ByteDance. Seedream 5.0 Lite поддерживает интеллектуальную генерацию изображений по тексту и редактирование с несколькими входными изображениями.
Генерирует детальные визуальные результаты, точно следующие вашим инструкциям, с высоким эстетическим качеством и точным рендерингом текста с поддержкой референсных изображений
Премиум ИИ-апскейлер — увеличивает разрешение до 200x с сохранением деталей лиц, текстур и мелких элементов
Удаление фона с помощью ИИ — создаёт чистые прозрачные PNG с точным определением краёв
Chat 15
Флагман семейства GPT-5.6: максимальный интеллект OpenAI, контекст 1М токенов.
Сбалансированная модель GPT-5.6: интеллект флагмана прошлого поколения при вдвое меньшей цене.
Самая быстрая и экономичная модель семейства GPT-5.6.
Новейшая модель Anthropic: уровень Opus в агентных задачах и кодинге по цене Sonnet.
Самая быстрая и интеллектуальная модель Claude Haiku
Флагман Anthropic: лучший результат в агентных задачах, длинных цепочках рассуждений и сложном коде. Контекст 1 млн токенов, мышление до уровня «максимум».
Модель xAI для кодинга и агентных задач: вдвое эффективнее по токенам, контекст 500k, зрение и инструменты.
Быстрая и экономичная модель DeepSeek V4 с контекстом 1M токенов. Поддерживает режимы обычного ответа и расширенного рассуждения (thinking), подходит для чата, написания текстов и программирования.
Мощная модель DeepSeek V4 для сложных задач анализа, рассуждений и программирования. Контекст 1M токенов, поддержка цепочки мыслей (CoT) и вызова инструментов.
Флагманская мультимодальная модель Moonshot AI (2.8T параметров) со встроенными рассуждениями и контекстом 1M токенов. Очень сильна в сложном коде, знаниях и длинных агентных сценариях.
Флагманская открытая модель Z.ai (Zhipu) с контекстом 1M токенов. Сильный кодинг и рассуждения близко к фронтиру при низкой цене.
Флагман Alibaba Qwen: гибридные рассуждения с настройкой глубины, понимание изображений и видео, контекст 1M токенов. Уверенно конкурирует с закрытыми фронтир-моделями по кодингу и анализу.
Сверхдешёвая рабочая модель Qwen с поддержкой изображений и контекстом 1M токенов. Идеальна для массовых задач и экономных тарифов.
Мощная модель Google с продвинутыми рассуждениями, полной мультимодальностью (текст, изображения, видео, аудио) и контекстом 1M токенов.
Новая рабочая лошадка Google (август 2026): заметный скачок в кодинге и агентных задачах, мультимодальность, контекст 1M токенов — быстрее и дешевле предшественницы.
Audio 6
Универсальная модель распознавания речи
Модель преобразования текста в речь, оптимизированная для скорости
Модель преобразования текста в речь, оптимизированная для качества
Grok TTS от xAI — 5 выразительных голосов с автоопределением языка (20+ языков)
Флагманская TTS Fish Audio: инлайн-теги эмоций, многоголосые диалоги, нативный русский.
Универсальная аудио-модель ByteDance: озвучка с естественной интонацией, клонирование голоса по короткому образцу, многоголосые диалоги, фоновые шумы и музыка.
Need credits?
Every plan comes with a monthly credit pack — the bigger the pack, the cheaper each credit.
See plansA model priced for Cyrillic is billed per UTF-8 byte: a Russian character takes two bytes and a Latin one takes a single byte, so the same text in Latin costs about half. Image and video prices are estimates for default settings — length, resolution and quality change the cost, and the composer shows the estimate for your exact settings before you run a generation. Chat is billed by tokens: 1,000 tokens is roughly 750 words; the prompt and the reply are priced separately.