Z-Image — модель генерации изображений нейросетью, которая специализируется на фотореализме без глянца. Её конёк — бытовые кадры: люди на кухне, двор у подъезда, стол с недопитым чаем. Снимки выходят такими, будто их сделали на обычную камеру, а не отрендерили. Управление предельно простое: описание, соотношение сторон и формат файла.

Большинство генераторов по умолчанию приукрашивают: идеальная кожа, студийный свет, композиция как из стока. Эта модель идёт другим путём — она воспроизводит обыденность. Мятая футболка, естественные тени от окна, лёгкий беспорядок на столе: детали, из-за которых кадр читается как настоящая фотография, а не иллюстрация.
Такой почерк востребован там, где глянец отталкивает. Соцсети устали от вылизанных стоковых улыбок, и «живой» кадр собирает больше доверия. Иллюстрация к тексту про быт, семейный блог, обложка подкаста о повседневности — везде, где нужна достоверность, а не парадность, модель попадает в тон.
Сильная зона — интерьеры и люди в естественных ситуациях: завтрак у окна, ребёнок с собакой в коридоре, мастер за верстаком, очередь у киоска. Хорошо выходят и предметные кадры «как снято на телефон»: еда на столе без фуд-стайлинга, вещи на полке, рабочее место как есть.
Слабее модель показывает себя в том, что далёко от фотографии: фэнтези-миры, аниме, плакатная графика с крупным текстом. Для таких задач в списке моделей на странице есть более подходящие варианты. Держите за правило: если итог должен выглядеть снимком из жизни — сюда, если рисунком или постером — в соседний пункт меню.

Соотношение сторон выбирается из пяти вариантов: квадрат 1:1, горизонтальные 4:3 и 16:9, вертикальные 3:4 и 9:16. Вертикальные пропорции удобны для сторис и лент мобильных приложений, широкие — для обложек статей и видео. Формат сохранения — JPEG или PNG на выбор.
Референсы модель не принимает — это чистый text-to-image, кадр строится только по описанию. Поэтому весь контроль — в тексте: упоминайте время суток, источник света, точку съёмки, состояние предметов. «Кухня утром, солнце сбоку из окна, на столе крошки от тоста» даст куда более живой кадр, чем просто «кухня».
Формулируйте описание как сцену, подсмотренную в реальности, а не как постановку. Полезно указывать несовершенства: потёртости, складки, случайные предметы на фоне. Именно они убеждают глаз. Помогают и «камерные» слова: снято на телефон, естественное освещение, лёгкая размытость заднего плана.
Дальше — обычный цикл: сгенерировали, посмотрели, уточнили формулировку, повторили. Все результаты складываются в историю генераций, откуда их можно скачать или переиспользовать промпт. Списание идёт с общего баланса токенов, единого для всех инструментов сайта, оплата в рублях. Цена не зависит от того, JPEG вы выбрали или PNG.
Нет, модель работает только по тексту, без референсов. Если нужно переделать существующий снимок, выберите в списке моделей ту, что поддерживает загрузку изображений, например из семейств Seedream или Flux, и опишите нужные правки там.
Модель генерирует вымышленных людей по описанию: возраст, внешность, одежда, обстановка. Портретное сходство с конкретным человеком не гарантируется и не является целью. Для сюжетов с реальным лицом используйте модели с поддержкой референсных фото.
JPEG весит меньше и удобен для публикаций в соцсетях и мессенджерах. PNG сохраняет картинку без потерь сжатия — берите его, если планируете дорабатывать кадр в редакторе или печатать. На сам сюжет выбор формата не влияет.