21 апреля OpenAI представила GPT Image 2 — следующее поколение генерации изображений. Это первое крупное обновление семейства GPT Image с декабря 2025 года. Модель быстрее, точнее передаёт текст, лучше справляется с фотореализмом и понимает больше языков.
GPT Image 2 доступна в официальном API OpenAI как gpt-image-2. Мы подключили её в Fyro в первый же день.
Что изменилось
Генерация за один проход
GPT Image 1.5 работала в две стадии: сначала изображение в низком разрешении, затем увеличение. На это уходило 8–12 секунд, а на стыках изредка появлялись артефакты.
GPT Image 2 создаёт изображение за один проход. Архитектура полностью новая и не основана на конвейере GPT-4o.
- Меньше 3 секунд вместо 8–12.
- Композиция, цвет и детали согласованы в пределах одного прохода.
- Больше одновременных запросов — можно строить конвейеры в реальном времени.
Текст почти без ошибок
Буквы долго оставались слабым местом генеративных моделей. У GPT Image 1.5 точность текста составляла 90–95%, и длинные строки регулярно «плыли».
GPT Image 2 передаёт текст почти со 100% точностью — на плакатах, макетах интерфейсов, заголовках, этикетках и печатях. Это позволяет создавать:
- рекламные постеры с читаемой типографикой;
- макеты интерфейсов с правильными подписями и кнопками;
- инфографику с точными числами и заголовками;
- упаковку и вывески со сложными шрифтами.
Многоязычная типографика
OpenAI отдельно отмечает рост качества в нелатинских письменностях: японской, корейской, китайской, арабской, хинди, греческой, бенгальской, деванагари — и кириллице. Кириллица теперь выходит так же точно, как английский текст. Для русскоязычных постеров, макетов и обложек это решающее изменение.
Один макет можно выпустить на нескольких языках, не пересобирая композицию в графическом редакторе.
Фотореализм
В слепых тестах LM Arena больше 70% участников принимали изображения GPT Image 2 за настоящие фотографии. Исчез желтоватый оттенок, характерный для версии 1.5: цвет стал точным, как в кино.
Модель уверенно работает и в узких стилях: уличная съёмка на 35 мм, кинопортреты с атмосферным светом, модная редакционная съёмка, случайные кадры на плёнку. Она различает студийный портрет и случайное селфи так же, как фотограф.
Знание реального мира
GPT Image 2 знает, как выглядят реальные вещи: логотипы, интерфейсы крупных продуктов, архитектурные детали, городские панорамы. Попросите скриншот главной страницы YouTube с новым логотипом — расположение кнопок, цвета и структура будут почти как в оригинале.
Поэтому модель подходит не только для творческих задач, но и для концептов продуктов, конкурентного анализа и презентаций.
Формат 16:9 и гибкие размеры
Раньше были доступны только 1024×1024, 1536×1024 и 1024×1536. GPT Image 2 добавляет:
- 1792×1024 (16:9) — превью для YouTube, баннеры, слайды;
- 1024×1792 (9:16) — вертикальные сторис, Reels и TikTok;
- любые размеры до 4K с соотношением сторон до 3:1 — через API.
GPT Image 2 и GPT Image 1.5
GPT Image 2 — скорость, текст и фотореализм:
- один проход и меньше 3 секунд на изображение;
- текст и типографика почти без ошибок;
- фотореализм, который проходит слепые тесты;
- форматы 16:9 и 9:16 без дополнительных настроек;
- уверенная работа с разными языками, включая кириллицу.
Примеры
Изображения ниже созданы в GPT Image 2 без постобработки.
Доступность
GPT Image 2 доступна в разделе изображений Fyro. Выберите модель в списке или откройте её страницу.