Grok — генерация изображений нейросетью в духе переписки с чат-ботом: написали фразу, получили картинку. Никаких длинных панелей с ползунками — одно поле для текста, выбор пропорций и кнопка. Модель понимает разговорные формулировки и не требует «промпт-инженерии», поэтому подходит тем, кто пробует нейросети впервые или просто хочет результат за минуту.

Главная особенность модели — терпимость к живому языку. Запрос можно писать так, как вы сказали бы человеку: «кот в скафандре чинит спутник, вид из космоса». Не нужно перечислять технические слова про освещение, линзы и стили — модель сама достроит сцену до законченного кадра с внятной композицией.
Это заметно снижает порог входа. Там, где другие генераторы вознаграждают длинные выверенные описания, здесь короткая фраза уже даёт пристойный результат. А если что-то не понравилось — быстрее переформулировать и запустить снова, чем настраивать десяток параметров. Такой цикл «фраза — картинка — правка» и делает работу похожей на диалог.
Из параметров у модели только соотношение сторон: 3:2 по умолчанию, а также 2:3, квадрат 1:1, вертикальное 9:16 под сторис и горизонтальное 16:9 под обложки и презентации. Этого хватает для большинства бытовых задач — остальное модель решает сама, без вопросов к пользователю.
Есть нюанс: если вы прикладываете к запросу своё фото, выбор пропорций отключается — итоговый кадр подстроится под загруженное изображение автоматически. Это не ошибка интерфейса, а осознанное поведение: модель сохраняет формат исходника, чтобы не растягивать и не обрезать вашу картинку.

К запросу прикладывается один референсный снимок. Дальше текстом описываете, что с ним сделать: поменять фон за спиной, добавить предмет в руку, превратить дневной кадр в вечерний, переодеть героя в другой костюм. Модель отталкивается от вашего изображения и переделывает его по инструкции.
Лучше всего работают конкретные короткие просьбы об одном изменении за раз. «Сделай фон закатным» сработает точнее, чем «улучши фото и поменяй всё». Если правок несколько, вносите их по очереди: результат первой генерации скачайте и загрузите как референс для следующей.
Модель закрывает повседневные сценарии: иллюстрация к посту, шутка в рабочий чат, открытка коллеге, быстрый набросок идеи для обсуждения, заглушка в презентацию. Скорость и простота тут важнее тонкого контроля, и именно на это она настроена. Результаты попадают в историю генераций — можно скачать или повторить запрос позже.
Если же нужен плакат с выверенной типографикой, серия картинок в едином стиле или сложная сцена с десятком объектов, посмотрите на соседние модели в списке: у них больше настроек и референсов. Баланс токенов общий, так что переключение между моделями ничего не ломает — пробуйте и сравнивайте.
Нет. Пишите обычной фразой, как сообщение собеседнику: кто в кадре, что делает, где происходит. Модель сама доведёт описание до полноценной сцены. Уточнения вроде стиля или времени суток можно добавлять по желанию.
С референсом кадр автоматически повторяет формат вашего снимка, чтобы ничего не обрезать и не растянуть. Выбор соотношения сторон действует только для генерации с чистого листа, без приложенного изображения.
Одно изображение за раз. Если задумана цепочка правок, делайте их последовательно: сгенерировали, скачали результат, загрузили его референсом и попросили следующее изменение. Так каждая ступень остаётся под контролем.