21 апреля OpenAI представила GPT Image 2 — следующее поколение генерации изображений. Это первое крупное обновление семейства GPT Image с декабря 2025 года. Модель быстрее, точнее передаёт текст, лучше справляется с фотореализмом и понимает больше языков.

GPT Image 2 доступна в официальном API OpenAI как gpt-image-2. Мы подключили её в Fyro в первый же день.

Что изменилось

Генерация за один проход

GPT Image 1.5 работала в две стадии: сначала изображение в низком разрешении, затем увеличение. На это уходило 8–12 секунд, а на стыках изредка появлялись артефакты.

GPT Image 2 создаёт изображение за один проход. Архитектура полностью новая и не основана на конвейере GPT-4o.

  • Меньше 3 секунд вместо 8–12.
  • Композиция, цвет и детали согласованы в пределах одного прохода.
  • Больше одновременных запросов — можно строить конвейеры в реальном времени.

Текст почти без ошибок

Буквы долго оставались слабым местом генеративных моделей. У GPT Image 1.5 точность текста составляла 90–95%, и длинные строки регулярно «плыли».

GPT Image 2 передаёт текст почти со 100% точностью — на плакатах, макетах интерфейсов, заголовках, этикетках и печатях. Это позволяет создавать:

  • рекламные постеры с читаемой типографикой;
  • макеты интерфейсов с правильными подписями и кнопками;
  • инфографику с точными числами и заголовками;
  • упаковку и вывески со сложными шрифтами.

Многоязычная типографика

OpenAI отдельно отмечает рост качества в нелатинских письменностях: японской, корейской, китайской, арабской, хинди, греческой, бенгальской, деванагари — и кириллице. Кириллица теперь выходит так же точно, как английский текст. Для русскоязычных постеров, макетов и обложек это решающее изменение.

Один макет можно выпустить на нескольких языках, не пересобирая композицию в графическом редакторе.

Фотореализм

В слепых тестах LM Arena больше 70% участников принимали изображения GPT Image 2 за настоящие фотографии. Исчез желтоватый оттенок, характерный для версии 1.5: цвет стал точным, как в кино.

Модель уверенно работает и в узких стилях: уличная съёмка на 35 мм, кинопортреты с атмосферным светом, модная редакционная съёмка, случайные кадры на плёнку. Она различает студийный портрет и случайное селфи так же, как фотограф.

Знание реального мира

GPT Image 2 знает, как выглядят реальные вещи: логотипы, интерфейсы крупных продуктов, архитектурные детали, городские панорамы. Попросите скриншот главной страницы YouTube с новым логотипом — расположение кнопок, цвета и структура будут почти как в оригинале.

Поэтому модель подходит не только для творческих задач, но и для концептов продуктов, конкурентного анализа и презентаций.

Формат 16:9 и гибкие размеры

Раньше были доступны только 1024×1024, 1536×1024 и 1024×1536. GPT Image 2 добавляет:

  • 1792×1024 (16:9) — превью для YouTube, баннеры, слайды;
  • 1024×1792 (9:16) — вертикальные сторис, Reels и TikTok;
  • любые размеры до 4K с соотношением сторон до 3:1 — через API.
Три уровня качества — low, medium и high — позволяют выбрать баланс между ценой и детализацией.

GPT Image 2 и GPT Image 1.5

GPT Image 2 — скорость, текст и фотореализм:

  • один проход и меньше 3 секунд на изображение;
  • текст и типографика почти без ошибок;
  • фотореализм, который проходит слепые тесты;
  • форматы 16:9 и 9:16 без дополнительных настроек;
  • уверенная работа с разными языками, включая кириллицу.
GPT Image 1.5 — прозрачный фон. На момент выхода GPT Image 2 только версия 1.5 умела отдавать PNG с прозрачным фоном. Для иконок, логотипов и элементов композиции без фона она оставалась лучшим выбором.

Примеры

Изображения ниже созданы в GPT Image 2 без постобработки.

Ночной портрет со вспышкой, как на плёнку Компьютерный класс в стиле 2000-х Кампус Cornell University — точная архитектура и текст на баннере Сюрреалистичный портрет с пуделем и вороной

Доступность

GPT Image 2 доступна в разделе изображений Fyro. Выберите модель в списке или откройте её страницу.