GPT Image 2 от OpenAI это верхняя ступень линейки OpenAI: её берут под бриф на половину страницы, под сборку кадра из мудборда и под 4K сразу в печать. Окно промпта и число референсов здесь те же, что у GPT Image 1.5, а платите вы за нативное 4K и за пропорции 16:9 и 9:16, которых у младшей нет.
| Тип | Изображения (Text-to-Image, Image-to-Image) |
| Автор модели | OpenAI |
| Цена | 6 / 10 / 16 токенов (за 1K / 2K / 4K) |
| Пропорции | auto, 1:1, 16:9, 9:16, 4:3, 3:4 |
| Референсы | До 16 входных изображений |
| Формат вывода | PNG |
Зачем нужна эта модель
GPT Image 2 это инструмент для тяжёлого продакшена, который больше не заставляет вас ужимать техническое задание в короткий абзац.
- Мега-бриф (до 20 000 символов). Вы можете скопировать в запрос целый брендбук, расшифровку звонка с клиентом или детальный сценарий кадра. Модель не «забудет» ни одной детали.
- Мульти-референсы. Соберите коллаж: лукбук, мудборд по цветам и фотографии продукта (до 16 файлов). GPT Image 2 синтезирует из них единый визуальный стиль без необходимости обучать собственные LoRA-модели.
- Нативное 4K. Изображения можно сразу отдавать в широкоформатную печать без использования сторонних апскейлеров: детализация просчитывается изначально.
- Популярные пропорции без обрезки. Доступны кинематографичные
16:9(для YouTube и баннеров) и вертикальные9:16(для Stories/Reels): больше не нужно генерировать квадрат и пытаться дорисовать края.
Когда выбирать GPT Image 2
- У вас огромный маркетинговый бриф с жёсткими гайдлайнами по цветам, свету и композиции.
- Вы собираете сложную сцену, требующую анализа большого мудборда (от 8 до 16 исходников).
- Вы готовите материалы в печать: кинопостеры, обложки книг, дизайн упаковки в 4K.
- Нужны готовые вертикальные форматы (
9:16) или горизонтальные обложки (16:9) с идеальной типографикой.
Когда лучше взять облегчённую версию
- Нужны те же длинные промпты (до 20 000 символов) и 16 референсов, но без 4K и широких форматов: на GPT Image 1.5 массовые черновики обойдутся в 2 раза дешевле.
Когда лучше вернуться к GPT Image 1
- Если вам нужна маска для Inpainting (возможность кисточкой выделить часть кадра для перерисовки). Вторая версия поддерживает только работу с картинкой целиком (Image-to-Image).
Ключевые сильные стороны
- Глубокий контекст. Лимит в 20 000 символов это настоящая революция. Вы можете структурировать промпт по разделам:
[Композиция],[Свет],[Типографика],[Палитра],[Строгие запреты]. Модель послушно отработает каждый блок. - Синтез стилей. Возможность загрузить 16 фото позволяет нейросети глубоко понять эстетику вашего бренда и перенести её на новые генерации, сохраняя консистентность.
- Безупречная типографика. Все плюсы OpenAI на месте: читаемые надписи, логотипы, бейджи и тексты на вывесках генерируются без генеративных искажений.
- Пространственное мышление. Модель прекрасно понимает предлоги. Если вы напишете «красная кружка стоит за синей вазой, а слева лежит яблоко», объекты будут расставлены именно так.
Популярные сценарии
- Режиссёрский фотобриф. Распишите кадр на половину страницы (эмоции актёров, тип объектива, марка плёнки, схема освещения, цветокоррекция): GPT Image 2 воспримет это как прямое руководство к действию.
- Печатная продукция. Промпт + пропорция
3:4+ разрешение4K= готовый плакат или обложка журнала для отправки в типографию. - Дизайн для соцсетей. Генерируйте обложки для видео в нативном
16:9или сторис в9:16, сразу добавляя нужные рекламные слоганы прямо в промпт. - Брендинг по гайдлайну. Текстовое описание бренда + 5-10 примеров старых макетов в качестве референсов дадут вам новую серию баннеров в фирменном стиле.
Настройки запроса
- Промпт: До 20 000 символов.
- Пропорции (Аспект):
auto(модель подберёт сама), квадрат1:1, горизонтальные16:9и4:3, вертикальные9:16и3:4. - Разрешение:
1K(базовое),2K(повышенное) или4K(максимальное). - Референсы: От 0 до 16 изображений (если загружены, включается режим Image-to-Image; если нет, Text-to-Image).
Важные ограничения
- Авто-разрешение: Если вы выбрали пропорцию
auto, модель сгенерирует картинку только в разрешении1K. - Ограничения для 4K: При выборе квадратного формата (
1:1) максимальное разрешение: 2K. Если вам нужно нативное4K, используйте прямоугольные форматы (например,16:9,9:16,4:3или3:4). - Нет точечных правок (Inpainting): GPT Image 2 не поддерживает работу с ручными масками. Для закрашивания конкретных деталей используйте базовую GPT Image 1 или модели семейства Nano Banana.
- Модерация: Встроены строгие Safety-фильтры OpenAI. Запросы с жестокостью, политикой или NSFW будут отклонены.
FAQ
В чём главное отличие от первой версии (GPT Image 1)?
Это следующий шаг эволюции: выросла длина промпта (с 5 000 до 20 000 символов), увеличилось число референсов (с 5 до 16), появилась поддержка 4K и популярных широких/узких форматов (16:9, 9:16). Единственное, в чём вторая версия пока уступает первой: поддержки масок (Inpainting) тут нет.
Можно ли передать одновременно референсы и маску?
Нет. Во второй версии маски пока не поддерживаются, поэтому используйте только промпт и референсы для изменения всего изображения целиком (Image-to-Image).
Сколько стоит генерация?
Цена зависит от выбранного разрешения: 6 токенов за 1K, 10 токенов за 2K и 16 токенов за флагманское 4K (за одно изображение).
Можно ли использовать результат в коммерческих целях?
Да. Вы получаете все права на использование сгенерированного контента в бизнесе при условии соблюдения общих правил и политик OpenAI.






