← Все статьи

ChatGPT Images 2.5 (Sunburst i Flare): co potrafi nowy model i jak go wypróbować w przeglądarce

Ogłoszenie GPT-Image-2.5: modele Sunburst i Flare, kadr z oficjalnego demo OpenAI

OpenAI wypuściło nową generację generowania obrazu — GPT-Image-2.5. Rodzina obejmuje dwa modele: Sunburst, skupiający się na ostrzejszych szczegółach, bardziej naturalnym oświetleniu i większej kontroli nad edycjami, oraz Flare, zbudowany z myślą o szybkości. Obydwa obsługują przezroczyste tła i są dostępne za pośrednictwem API. Dodaliśmy oba warianty rodziny do naszej witryny jako ChatGPT Images 2.5 — możesz generować i edytować obrazy bezpośrednio w przeglądarce, nie API potrzebne klucze lub subskrypcje: strona modelu NeuralSpace (link otwiera generator z wybranym już modelem).

Kadr z oficjalnego dema OpenAI: zapowiedź GPT-Image-2.5 — modele Sunburst i Flare

Co nowego w porównaniu do poprzedniej generacji

Według OpenAI, Sunburst rysuje zauważalnie ostrzejsze szczegóły z bardziej naturalne oświetleniei — co najważniejsze — zapewnia większą kontrolę podczas edycji: długie serie edycji pojedynczej klatki nie rozpadają się już. Flare to szybkie rodzeństwo: dostarcza wysokiej jakości obrazy ponad 50% szybciej.

Obydwa warianty dostępne są na stronie: Sunburst za jakość i precyzję edycji, Flare za szybkość i wypróbowanie pomysłów. Cena nie zależy od wariantu – tylko od rozdzielczości.

Dwa warianty i trzy rozdzielczości zamiast poziomów jakości

Generacja 2.5 nie ma skali od niskiej do maksymalnej: zamiast tego jest wariant i rozdzielczość. Sunburst rysuje precyzyjniej i przestrzega granic edycji; Flare pozwala uzyskać gotową klatkę zauważalnie szybciej. Rozdzielczość określa szczegółowość i cenę: 1K za projekty i wypróbowywanie pomysłów, 2K jako środek roboczy dla mediów społecznościowych i stron internetowych, 4K jako finalny do druku i wielkoformatowy.

Strategia ekonomiczna: szkice dalej Flare 1K, jeden finał Sunburst 2K Lub 4K od najlepszego podpowiedzi. Cena jest liczona za zdjęcie i pokazana zanim klikasz generuj — brak niespodzianek związanych z saldem, a jeśli generowanie się nie powiedzie, tokeny zostaną automatycznie zwrócone.

Seria zmian z jednego obrazu źródłowego

Charakterystyczną umiejętnością tego pokolenia jest edycja. W OpenAIW oficjalnej wersji demonstracyjnej jednej klatki początkowej wprowadza się długą serię zmian: zmień kolor kurtki, zastąp tło, dodaj okulary, przełącz scenę na deszczową pogodę, przerysuj ją pastelami lub akwarelą architektoniczną — a każdy krok zmienia tylko to, o co prosiłeś.

Kadr z oficjalnego demo OpenAI: seria zmian na jednym obrazie źródłowym — kolor kurtki, tło, okulary

Na stronie tryb edycji włącza się automatycznie: dołącz od jednego do szesnastu zdjęć referencyjnych (do 30 MB każdy) i napisz instrukcję. Nie ma osobnego przełącznika — model rozumie tryb na podstawie obecności obrazów w żądaniu.

Co ChatGPT Demo aplikacji pokazuje: szkic, ukierunkowane zmiany i szablony

Wraz z premierą modelu, OpenAI odświeżył ChatGPT sama aplikacja, a praktyczne recenzje dobrze pokazują charakter tego pokolenia. Pierwszy, dane wejściowe oparte na szkicu: w aplikacji możesz narysować przybliżony schemat sceny (pudełko na kanapę, okna, sylwetka psa), a model zamienia bazgroł w pełne wnętrze — interpretuje szkic nawet bez instrukcji tekstowych. Generacja również wydaje się zauważalnie szybsza niż wcześniej.

Drugi, ukierunkowane narzędzia do edycji na górze gotowej ramki: zakreśl obszar i poproś o „umieszczenie tutaj kota”, zostaw kilka komentarzy w jednym pakiecie („uczyń tę roślinę martwą”, „dodaj tęczę na zewnątrz”, „pokoloruj ściany na szaro”), zaznacz obiekt gumką, aby model wiedział, co usunąć i czysto wypełnił lukę. Narzędzie do usuwania tła oddziela wyraźny obiekt od tła jednym kliknięciem.

Trzeci, zdjęcia referencyjne. Recenzje pokazują, że modelka przywraca stare zdjęcia (usuwa odblaski, sprząta, ubiera dzieciaka – i to wciąż ten sam dzieciak), projektuje na nowo prawdziwe przestrzenie (żwirowe podwórko zamienia się w ogród skalny) i składa trzy osobne portrety w jedno zdjęcie. Kolejną wyróżniającą się umiejętnością jest zachowanie tożsamości: ludzie i zwierzęta pozostają rozpoznawalni w długich seriach edycyjnych — obraz nie pogarsza się z iteracji na iterację, co zwykle było krytykowane za modele obrazów. Aplikacja również zyskała szablony — punkty wyjścia dla popularnych formatów: logo, plakaty, architektura wnętrz, ilustracja.

Dane wejściowe i szablony szkicu są ChatGPT udogodnienia aplikacji i nie są częścią API. Na naszej stronie oba warianty — Sunburst I Flare — dostępne są: generowanie tekstu na obraz, edycja na podstawie referencji (do 16 obrazów po 30 MB każdy — przywracanie, ponowne kolorowanie, zamiana tła, zmiana stylizacji), 1K/2K/4K rozdzielczości i kilkanaście współczynników proporcji. Aby przywrócić lub przerobić zdjęcie na stronie, po prostu dołącz je jako odniesienie i napisz instrukcję.

Oddzielnym praktycznym przypadkiem od recenzji jest miniatury wideo: autor montuje chwytliwe YouTube podgląd serii zmian (mocniejsze tło, większy temat, czytelny wygląd) — ta sama mechanika edycji ukierunkowanej, tylko cel jest „klikalny”, a nie „ładny”. Na stronie zadanie to działa w ten sam sposób: dołącz ramkę jako odniesienie i dodaj instrukcję dotyczącą tła i akcentu.

Precyzja w szczegółach

Drugą cechą charakterystyczną jest szybkie przestrzeganie najdrobniejszych szczegółów: ile jest obiektów, po której stronie, co wskazuje zegar, ile pięter ma budynek. OpenAIDemo pokazuje klatki, w których model odtwarza jednocześnie kilka dokładnych warunków z opisu.

Kadr z oficjalnego demo OpenAI: model wiernie odwzorowuje szczegóły z opisu — pozy, liczba obiektów, wskazówki zegara

Natywna przezroczystość od razu po wyjęciu z pudełka

Oba modele w rodzinie wsparcia natywna przezroczystość: obiekt z pełnym kanałem alfa jest natychmiast gotowy do kolaży, układów lub gier — bez konieczności ręcznego wycinania. Demo pokazuje obiekt wkomponowany w nowe tła.

Kadr z oficjalnego dema OpenAI: natywna przezroczystość — pełna PNG alfa, obiekt jest umieszczany na nowym tle

Uwaga dotycząca serwisu: generator nie ma osobnego przełącznika z przezroczystym tłem — w tej sekcji opisano, co model może zrobić w trybie OpenAI demo, a nie opcja na stronie modelu.

Ile to kosztuje

OpenAIstawki tokenów za 2,5 odpowiadają poprzedniej generacji, a na stronie cena za obraz zależy tylko od rozdzielczości (1K/2K/4K) — zawsze wyświetlane przed naciśnięciem przycisku Generuj. Przeciągi dalej Flare 1K, finały Sunburst 2K Lub 4K. Płacisz z wewnętrznego salda tokenów; nie wymaga subskrypcji.

Wypróbuj w przeglądarce

Model jest już dostępny w studiu generowania obrazu: wybierz „ChatGPT Images 2.5" na liście modeli opisz ramę i w razie potrzeby dołącz referencje. Otwarte ChatGPT Images 2.5 NA NeuralSpace.