Źródła
Zrób to po swojemu
Zainspirowała Cię ta historia? Zamień pomysł we własną sztukę AI w kilka sekund — zacznij za darmo, bez karty.
Zacznij za darmoPogadaj o tym z
Wybierz towarzysza i poznaj jego zdanie na temat tej historii

Iris pisze o styku sztuki AI i kultury — o stylu, autorstwie i obrazach, które mają znaczenie.
Zainspirowała Cię ta historia? Zamień pomysł we własną sztukę AI w kilka sekund — zacznij za darmo, bez karty.
Zacznij za darmoWybierz towarzysza i poznaj jego zdanie na temat tej historii
OpenAI uruchomiło ChatGPT Images 2.5 we wtorek, a jego główna funkcja — Sketch — pozwala narysować przybliżony kształt bezpośrednio w oknie czatu, a następnie opisać tekstem, jak ma zostać przekształcony w gotowy obraz.
Procedura jest prostsza, niż się wydaje. Rysujesz coś — przybliżoną sylwetkę kota, układ pokoju, postać w pejzażu — bezpośrednio w interfejsie ChatGPT, a następnie wpisujesz, jak ma wyglądać gotowy obraz. Model interpretuje Twój zamysł przestrzenny i renderuje odpowiednio, według The Verge.

Wygenerowany przez AI obraz kota stworzony przez ChatGPT Images 2.5 na podstawie odręcznego szkicu.
Obraz: The Verge / The Verge AI
Dla twórców sztuki AI praktyczna zmiana polega tu na kontroli kompozycji. Tekstowe prompty są precyzyjne w kwestii tematu i stylu, ale notoryczne niepewne w kwestii rozmieszczenia przestrzennego — umieszczenie postaci w lewej trzeciej kadru czy linii horyzontu na określonej wysokości zawsze wymagało albo obejść z inpaintingiem, albo rozbudowanej inżynierii promptów. Sketch oddaje tę kontrolę dosłownie w ręce twórcy. Dziesięciosekundowy szkic może naprawić to, czego nie potrafią trzy akapity tekstu promptu.

Interfejs Sketch w ChatGPT Images 2.5 pokazujący przekształcenie odręcznego rysunku w wyrenderowany obraz AI.
Obraz: The Verge / The Verge AI
Warto tu wskazać rodowód tej funkcji: to logika szkicu komiksowego, miniatury animatora, gestycznego podrysu, który stanowi fundament kompozycji wizualnej od czasów renesansu. Sketch nie zastępuje tej tradycji — cyfryzuje jej pierwszy krok i przekazuje renderowanie modelowi.
Twórcy, którzy obecnie polegają na inpaintingu, referencjach pozycji w stylu ControlNet lub przepływach pracy image-to-image, aby naprawić kompozycję przestrzenną, mają teraz natywną, niskofrykcyjną alternatywę wewnątrz ChatGPT. Szkic nie musi być dobry — o to właśnie chodzi. Model odczytuje intencję, nie kunszt rysowniczy.
Niemniej jednak pułap jakości każdego podejścia opartego na szkicach zależy od tego, jak dobrze bazowy model obrazów interpretuje luźne dane przestrzenne. ChatGPT Images 2.5 to nowy model, a nie tylko warstwa interfejsu nałożona na istniejący, więc jego wierność wskazówkom przestrzennym będzie wymagała testowania w rzeczywistych zadaniach twórczych. Twórcy przyzwyczajeni do precyzji dedykowanych narzędzi, takich jak ControlNet czy regionalne promptowanie w Stable Diffusion, powinni traktować Sketch jako punkt wyjścia do szybkich iteracji, a nie jako potok finalnego wyjścia.
Dla każdego, kto tworzy postacie lub sceny na Charmloop, Sketch może skrócić wczesną fazę konceptualizacji — szkicowanie pozy lub układu sceny przed przystąpieniem do pełnego generowania obrazów. Przewodniki w /learn omawiają techniki promptowania skoncentrowane na kompozycji, które naturalnie współgrają z tego rodzaju przestrzennym wprowadzaniem danych.
Gdy kompozycyjny szkielet obrazu pochodzi z ludzkiej ręki — nawet niezdarnej — a model wypełnia każdy szczegół powierzchni, kwestia twórczego autorstwa staje się naprawdę interesująca. Sketch oddaje więcej generatywnych decyzji w ręce twórcy niż czysty prompt tekstowy, co ma znaczenie zarówno estetyczne, jak i — coraz częściej — prawne. Rysunek jest Twój; renderowanie należy do modelu. Ten podział jest czystszy niż to, co oferuje większość przepływów pracy z obrazami AI.
OpenAI nie podało szczegółów cenowych dla Images 2.5 poza informacją o jego dostępności w ChatGPT. Twórcy oceniający wybór modelu do prac z dużą ilością kompozycji mają teraz konkretny powód, by przetestować go obok swoich dotychczasowych narzędzi.