Все модели
Изображениеopenai

🖼️GPT Image 2

Тот же длинный бриф, плюс 4K и готовые 16:9 и 9:16

GPT Image 2 от OpenAI это верхняя ступень линейки OpenAI: её берут под бриф на половину страницы, под сборку кадра из мудборда и под 4K сразу в печать. Окно промпта и число референсов здесь те же, что у GPT Image 1.5, а платите вы за нативное 4K и за пропорции 16:9 и 9:16, которых у младшей нет.

ТипИзображения (Text-to-Image, Image-to-Image)
Автор моделиOpenAI
Цена6 / 10 / 16 токенов (за 1K / 2K / 4K)
Пропорцииauto, 1:1, 16:9, 9:16, 4:3, 3:4
РеференсыДо 16 входных изображений
Формат выводаPNG


Зачем нужна эта модель

GPT Image 2 это инструмент для тяжёлого продакшена, который больше не заставляет вас ужимать техническое задание в короткий абзац.

  • Мега-бриф (до 20 000 символов). Вы можете скопировать в запрос целый брендбук, расшифровку звонка с клиентом или детальный сценарий кадра. Модель не «забудет» ни одной детали.
  • Мульти-референсы. Соберите коллаж: лукбук, мудборд по цветам и фотографии продукта (до 16 файлов). GPT Image 2 синтезирует из них единый визуальный стиль без необходимости обучать собственные LoRA-модели.
  • Нативное 4K. Изображения можно сразу отдавать в широкоформатную печать без использования сторонних апскейлеров: детализация просчитывается изначально.
  • Популярные пропорции без обрезки. Доступны кинематографичные 16:9 (для YouTube и баннеров) и вертикальные 9:16 (для Stories/Reels): больше не нужно генерировать квадрат и пытаться дорисовать края.

Когда выбирать GPT Image 2

  • У вас огромный маркетинговый бриф с жёсткими гайдлайнами по цветам, свету и композиции.
  • Вы собираете сложную сцену, требующую анализа большого мудборда (от 8 до 16 исходников).
  • Вы готовите материалы в печать: кинопостеры, обложки книг, дизайн упаковки в 4K.
  • Нужны готовые вертикальные форматы (9:16) или горизонтальные обложки (16:9) с идеальной типографикой.

Когда лучше взять облегчённую версию

  • Нужны те же длинные промпты (до 20 000 символов) и 16 референсов, но без 4K и широких форматов: на GPT Image 1.5 массовые черновики обойдутся в 2 раза дешевле.

Когда лучше вернуться к GPT Image 1

  • Если вам нужна маска для Inpainting (возможность кисточкой выделить часть кадра для перерисовки). Вторая версия поддерживает только работу с картинкой целиком (Image-to-Image).

Ключевые сильные стороны

  1. Глубокий контекст. Лимит в 20 000 символов это настоящая революция. Вы можете структурировать промпт по разделам: [Композиция], [Свет], [Типографика], [Палитра], [Строгие запреты]. Модель послушно отработает каждый блок.
  2. Синтез стилей. Возможность загрузить 16 фото позволяет нейросети глубоко понять эстетику вашего бренда и перенести её на новые генерации, сохраняя консистентность.
  3. Безупречная типографика. Все плюсы OpenAI на месте: читаемые надписи, логотипы, бейджи и тексты на вывесках генерируются без генеративных искажений.
  4. Пространственное мышление. Модель прекрасно понимает предлоги. Если вы напишете «красная кружка стоит за синей вазой, а слева лежит яблоко», объекты будут расставлены именно так.

Популярные сценарии

  • Режиссёрский фотобриф. Распишите кадр на половину страницы (эмоции актёров, тип объектива, марка плёнки, схема освещения, цветокоррекция): GPT Image 2 воспримет это как прямое руководство к действию.
  • Печатная продукция. Промпт + пропорция 3:4 + разрешение 4K = готовый плакат или обложка журнала для отправки в типографию.
  • Дизайн для соцсетей. Генерируйте обложки для видео в нативном 16:9 или сторис в 9:16, сразу добавляя нужные рекламные слоганы прямо в промпт.
  • Брендинг по гайдлайну. Текстовое описание бренда + 5-10 примеров старых макетов в качестве референсов дадут вам новую серию баннеров в фирменном стиле.

Настройки запроса

  • Промпт: До 20 000 символов.
  • Пропорции (Аспект): auto (модель подберёт сама), квадрат 1:1, горизонтальные 16:9 и 4:3, вертикальные 9:16 и 3:4.
  • Разрешение: 1K (базовое), 2K (повышенное) или 4K (максимальное).
  • Референсы: От 0 до 16 изображений (если загружены, включается режим Image-to-Image; если нет, Text-to-Image).

Важные ограничения

  • Авто-разрешение: Если вы выбрали пропорцию auto, модель сгенерирует картинку только в разрешении 1K.
  • Ограничения для 4K: При выборе квадратного формата (1:1) максимальное разрешение: 2K. Если вам нужно нативное 4K, используйте прямоугольные форматы (например, 16:9, 9:16, 4:3 или 3:4).
  • Нет точечных правок (Inpainting): GPT Image 2 не поддерживает работу с ручными масками. Для закрашивания конкретных деталей используйте базовую GPT Image 1 или модели семейства Nano Banana.
  • Модерация: Встроены строгие Safety-фильтры OpenAI. Запросы с жестокостью, политикой или NSFW будут отклонены.

FAQ

В чём главное отличие от первой версии (GPT Image 1)?

Это следующий шаг эволюции: выросла длина промпта (с 5 000 до 20 000 символов), увеличилось число референсов (с 5 до 16), появилась поддержка 4K и популярных широких/узких форматов (16:9, 9:16). Единственное, в чём вторая версия пока уступает первой: поддержки масок (Inpainting) тут нет.

Можно ли передать одновременно референсы и маску?

Нет. Во второй версии маски пока не поддерживаются, поэтому используйте только промпт и референсы для изменения всего изображения целиком (Image-to-Image).

Сколько стоит генерация?

Цена зависит от выбранного разрешения: 6 токенов за 1K, 10 токенов за 2K и 16 токенов за флагманское 4K (за одно изображение).

Можно ли использовать результат в коммерческих целях?

Да. Вы получаете все права на использование сгенерированного контента в бизнесе при условии соблюдения общих правил и политик OpenAI.

Линейка GPT Image

Модели одного семейства по возрастанию цены

  1. GPT Image 1.53Понимает длинный подробный бриф и до 16 референсов сразу
  2. GPT Image 2вы здесь6Тот же длинный бриф, плюс 4K и готовые 16:9 и 9:16
  3. GPT Image 2.56Быстрый режим для потока и точный для финальных правок

Другие модели для изображений

Весь каталог
Изображение
bfl

Flux 2 Flash

от1

Самый дешёвый способ проверить идею, но текст в кадре выходит плохо

Попробовать
Изображение
bfl

Flux 2 Turbo

от1

Та же цена, что у Flash, но сложные сцены и свет выходят чище

Попробовать
Изображение

Muse Image

от3

Продумывает кадр перед отрисовкой, точна к сложным промптам и референсам

Попробовать
Изображение
google

Nano Banana

от4

Точечная правка словами: убрать предмет, заменить фон, без масок

Попробовать
Изображение
google

Nano Banana 2 Lite

от4

Дёшево и быстро для большинства задач, надписи латиницей и кириллицей

Попробовать
Изображение
bytedance

Seedream 4.5

от5

Живые лица и репортажная съёмка без пластиковой кожи

Попробовать

Попробуйте GPT Image 2 прямо сейчас

Открыть в редакторе