← Все статьи

ChatGPT Images 2.5 (GPT-Image-2.5 Sunburst): что умеет новая модель OpenAI и как попробовать в браузере

Анонс GPT-Image-2.5: модели Sunburst и Flare, кадр официального демо OpenAI

OpenAI выпустила новое поколение генерации изображений — GPT-Image-2.5. В семействе две модели: Sunburst — за резкость деталей, естественный свет и аккуратные серии правок, и Flare — за скорость. Обе поддерживают прозрачный фон и уже доступны по API. Мы добавили старшую модель семейства на сайт под именем ChatGPT Images 2.5 — генерировать и править картинки ей можно прямо в браузере, без ключей и подписок: страница модели на NeuralSpace.

Кадр официального демо OpenAI: анонс GPT-Image-2.5 — модели Sunburst и Flare

Что нового по сравнению с прошлым поколением

По словам OpenAI, Sunburst рисует заметно более резкие детали и более естественное освещение, а главное — даёт больше контроля в редактировании: серии правок по одному кадру не разваливают композицию. Flare — «скоростная» модель семейства: она отдаёт готовый кадр в высоком качестве более чем на 50% быстрее.

На сайте сейчас доступна Sunburst — она про качество и точные правки. Если спрос большой, Flare добавим следом.

Пять уровней проработки — от черновика до максимума

У прошлых моделей было три уровня качества. У 2.5 их пять: low, medium, high и два верхних — xhigh и max. Практика простая:

  • Low — дешёвые черновики: быстро перебрать композиции и ракурсы.
  • Medium — рабочая середина для соцсетей и сайта.
  • High — уверенный финал для большинства задач.
  • Xhigh и Max — когда решает мелкая фактура: печать, крупный формат, макро-детали.

Цена считается за каждую картинку и показывается до запуска генерации — баланс не сюрпризит.

Серии правок от одного исходника

Главная сильная сторона поколения — редактирование. В официальном демо OpenAI показывает длинную серию правок из одного стартового кадра: сменить цвет куртки, заменить фон, добавить очки, перевести сцену в дождливую погоду, перерисовать пастелью или акварелью — и каждый шаг меняет только то, что попросили.

Кадр официального демо OpenAI: серия правок одного исходного изображения — цвет куртки, фон, очки

На сайте режим правки включается сам: приложите от одного до шестнадцати референсов (до 50 МБ каждый) и напишите инструкцию. Отдельного переключателя нет — модель понимает режим по наличию картинок в запросе.

Что показывает демо в самом ChatGPT: скетч, точечные правки и шаблоны

Параллельно с выходом модели OpenAI обновила и сам ChatGPT, и обзор нового интерфейса хорошо показывает характер поколения. Первое — вход через скетч: в приложении можно нарисовать грубую схему комнаты (прямоугольник дивана, окна, силуэт собаки) — и модель достраивает из наброска полноценный интерьер, причём понимает набросок даже без текстовых инструкций. Генерация при этом ощущается заметно быстрее прежних версий.

Второе — точечные инструменты правки прямо поверх готового кадра: можно обвести область и попросить «посадите здесь кота», оставить сразу несколько комментариев одним пакетом («это растение сделай засохшим», «добавь радугу за окном», «сделай стены серыми»), выделить «ластиком» лишний объект — модель поймёт, что именно нужно убрать, и сотрёт его с аккуратным достроением фона. Отдельный инструмент удаляет фон: на кадрах с чётким объектом он отделяет человека или предмет от фона одним нажатием.

Третье — работа с референсными фото. В обзорах модель восстанавливает старые снимки (убрать блик, почистить, переодеть ребёнка в костюм — и это всё тот же ребёнок, один в один), перекраивает реальные пространства (двор с гравийной отсыпкой превращается в рокарий) и собирает один кадр из трёх отдельных портретов. Отдельная сильная сторона — сохранение внешности: и люди, и животные остаются собой через длинные серии правок, картинка не «сыпется» от итерации к итерации — то, за что раньше чаще всего ругали генерации. Плюс в приложении появились шаблоны — старт из популярных форматов: логотипы, постеры, дизайн интерьера, иллюстрация.

Скетч и шаблоны — удобства приложения ChatGPT, в API их нет. На сайте та же модель Sunburst доступна через прямой API OpenAI: генерация по описанию, правки по референсам (до 16 картинок по 50 МБ — реставрация, перекраска, замена фона, смена стиля), прозрачный фон и пять уровней проработки. Чтобы отреставрировать или переделать фото на сайте, просто приложите его как референс и напишите инструкцию.

Отдельный практический кейс из обзора — миниатюры для видео: автор собирает цепляющее превью для YouTube серией правок (фон поярче, крупный объект, читаемый образ) — та же механика точечных правок, только цель не «красиво», а «кликабельно». На сайте такая задача решается так же: приложите кадр как референс и допишите инструкцию про фон и акцент.

Точность в деталях

Вторая фирменная особенность — следование текстовому запросу до мелочей: сколько предметов, с какой стороны, какая цифра на часах, сколько этажей в доме. В демо OpenAI это показано на кадрах, где модель воспроизводит сразу несколько точных условий из описания.

Кадр официального демо OpenAI: модель воспроизводит точные детали из описания — позы, счёт предметов, положения стрелок

Прозрачный фон «из коробки»

Обе модели семейства поддерживают нативную прозрачность: объект с полноценным альфа-каналом сразу готов для коллажа, макета или игры — вырезать ничего не нужно. В демо это показано на примере объекта, который композитируется на новые фоны.

Кадр официального демо OpenAI: нативная прозрачность — PNG-альфа, объект переносится на новые фоны

На сайте для прозрачного фона выберите режим «Прозрачный» и формат PNG или WebP (JPEG прозрачность не хранит — форма сама подскажет).

Сколько стоит

Тарифы OpenAI у 2.5 совпадают с прошлым поколением, а на сайте цена за картинку зависит от уровня проработки и размера холста и всегда показывается до запуска. Экономная стратегия: черновики на low, финал — на high или выше. Оплата в рублях с внутреннего баланса, подписка не нужна.

Попробовать в браузере

Модель уже доступна в генерации изображений: выберите «ChatGPT Images 2.5» в списке моделей, опишите кадр и при необходимости приложите референсы. Открыть ChatGPT Images 2.5 на NeuralSpace.