Все модели
Изображениеxai

🤖Grok Imagine Image 2

Точечная правка выбранной области и вёрстка с читаемыми надписями

Grok Imagine Image 2.0 это вторая версия картиночной модели xAI, вышедшая 7 августа 2026 года. Первая версия продавала скорость и пакеты картинок разом; вторая продаёт противоположное — контроль. Точечная правка выбранной области, читаемая типографика, повторяемые элементы от кадра к кадру.

На публичных аренах на момент релиза модель заняла второе место и в генерации по тексту, и в редактировании, уступив только GPT Image 2: 1320 против 1380 Elo в text-to-image и 1439 против 1463 в редактировании. Для нашего каталога важнее другое: она стоит 5 токенов, то есть попадает в бюджетную полку, оставаясь моделью верхнего эшелона.

ТипИзображения (Text-to-Image, Image Edit)
Автор моделиxAI (Grok Imagine Image 2.0, август 2026)
Цена5 токенов за кадр, генерация и правка стоят одинаково
РеференсыДо 5 изображений
Пропорции1:1, 2:3, 3:2, 16:9, 9:16
ПромптДо 5000 символов
Формат выводаPNG


Для чего она

Одна карточка здесь закрывает два режима апстрима. Без референсов модель рисует с нуля, с референсами переключается в правку: до пяти входных изображений можно смешивать в один кадр или менять принесённый снимок по описанию. Переключение автоматическое, отдельную модель выбирать не надо.

Сильные стороны

  • Правка выбранной области. Модель заточена менять то, что просят, и не трогать остальное. Это её главный аргумент против «перегенерируй и надейся».
  • Читаемая типографика. Надписи задуманы как часть композиции, а не как декоративная текстура. Заголовок на постере, подпись на карточке товара, текст на вывеске выходят разборчиво.
  • Смешивание до пяти референсов. Персонаж с одного кадра, предмет со второго, стиль с третьего.
  • Повторяемость элементов. Один и тот же герой или предмет удерживается через серию кадров, что нужно для раскадровок и наборов карточек.
  • Цена уровня черновика при качестве уровня флагмана. Пять токенов за кадр из второй строчки арены это редкое сочетание в каталоге.

Когда брать что-то другое

  • Нужна длинная кириллица в кадре → GPT Image 2, она стабильнее на плотном русском тексте.
  • Нужны 2K или 4K → Nano Banana Pro или Seedream 5 Lite.
  • Нужны панорамные 21:9 или ультраширокие форматы → Seedream 5 Lite и Nano Banana 2.
  • Нужно больше пяти референсов → Seedream 5 Lite принимает до четырнадцати.

Что задаёте

  • Промпт: до 5000 символов. В режиме правки описывайте изменение, а не всю сцену заново: «замени фон на вечернюю улицу, персонажа оставь как есть».
  • Референсы: от 0 до 5 изображений. Пустой список означает генерацию с нуля.
  • Соотношение сторон: 1:1, 2:3, 3:2, 16:9, 9:16. Пять форматов, без экзотики.

Параметров разрешения, качества и формата файла у модели нет: апстрим сам решает, что отдать, и отдаёт PNG. Это не наше упрощение, а устройство самой модели.


Сценарии использования

  1. Постер с заголовком. Композиция и текст собираются за одну генерацию, без вёрстки в редакторе поверх картинки.
  2. Замена фона у продуктового снимка. Приложите фото товара и опишите новое окружение: предмет останется собой.
  3. Серия карточек с одним героем. Персонаж с референса проводится через несколько сцен и остаётся узнаваемым.
  4. Коллаж из пяти источников. Смешение референсов в одну сцену без ручной сборки в редакторе.
  5. Быстрая правка присланного макета. Пять токенов за итерацию делают перебор вариантов нормальной рабочей практикой.

Ограничения

  • Только PNG и только один размер. Ни выбора разрешения, ни выбора формата файла. Под печать берите модель с 4K.
  • Пять пропорций. Ни 21:9, ни 4:3, ни ультрашироких полос.
  • До пяти референсов. Для коллажа из десятка источников мало.
  • Кириллица. Заголовки в пару слов модель держит: постер выше с надписями «НОЧНАЯ СМЕНА» и «ИЗБРАННОЕ» сгенерирован с первой попытки без единой ошибки в буквах. А вот плотный мелкий текст и длинные слова с ь, ъ, щ остаются риском, как и у большинства моделей каталога. Проверяйте результат, а под сложную русскую вёрстку берите GPT Image 2.
  • Одна картинка за генерацию. В отличие от первой версии Grok Imagine, которая отдавала пакет кадров разом, здесь один запрос это один кадр.
  • История провайдера. У xAI бывали длительные периоды отказов на всех запросах. Если генерации подряд падают, это апстрим, а не ваш промпт: возвращайтесь позже или берите соседнюю модель.

FAQ

Чем она отличается от первой версии Grok Imagine?

Первая отдавала пакет из нескольких картинок за один вызов и брала скоростью. Вторая отдаёт один кадр, но управляемый: точечная правка, читаемый текст, повторяемые элементы. Это разные инструменты под разные задачи.

Как переключиться в режим правки?

Никак специально: приложите хотя бы одно изображение, и модель уйдёт в правку. Уберите референсы, и она снова рисует с нуля.

Сколько стоит правка?

Столько же, сколько генерация, 5 токенов.

Почему нельзя выбрать 2K?

У модели нет такого параметра. Апстрим отдаёт один размер и один формат.

Можно ли получить прозрачный фон?

В нашем интерфейсе нет. Для выреза объекта берите Recraft Remove BG.

Она рисует текст на русском?

Заголовки в одно-два слова да: пример на этой странице сделан за одну генерацию. Плотный мелкий текст и длинные слова с мягким и твёрдым знаками проверяйте глазами, а под сложную русскую вёрстку берите GPT Image 2.

Другие модели для изображений

Весь каталог
Изображение
bfl

Flux 2 Flash

от1

Самый дешёвый способ проверить идею, но текст в кадре выходит плохо

Попробовать
Изображение
bfl

Flux 2 Turbo

от1

Та же цена, что у Flash, но сложные сцены и свет выходят чище

Попробовать
Изображение
openai

GPT Image 1.5

от3

Понимает длинный подробный бриф и до 16 референсов сразу

Попробовать
Изображение
google

Nano Banana

от4

Точечная правка словами: убрать предмет, заменить фон, без масок

Попробовать
Изображение
google

Nano Banana 2 Lite

от4

Дёшево и быстро для большинства задач, надписи латиницей и кириллицей

Попробовать
Изображение
bytedance

Seedream 4.5

от5

Живые лица и репортажная съёмка без пластиковой кожи

Попробовать

Попробуйте Grok Imagine Image 2 прямо сейчас

Открыть в редакторе