02 - Modele kontekstowe i edycja multimodalna
Jak zmienić fragment zdjęcia w AI i zachować resztę?
W tej grupie punktem wyjścia może być istniejący obraz. Przekazujesz go do modelu i opisujesz zmianę: inne światło, tło, ubranie, rekwizyt, detal lub kompozycję. Pozostałe elementy obrazu mają zostać zachowane.
Modele kontekstowe - Nano Banana, FLUX Kontext czy Seedream - pozwalają zmienić koszulę na inną, wstawić produkt do sceny lifestyle'owej albo odtworzyć tę samą postać w różnych ujęciach. Wcześniej wymagało to Photoshopa, ręcznej pracy grafika albo sesji zdjęciowej. Teraz wystarczy zdjęcie referencyjne i prompt.
Z praktyki: jedno zdanie, które ratuje kadr. Czasem trzeba wprost poprosić model, żeby zachował elementy z referencji. Jeśli zmieniam coś na zdjęciu, wpisuję: zachowaj całą strukturę zdjęcia, a podmień daną postać.
Z praktyki: kolor marki. Kod HEX w prompcie daje kolor bardzo zbliżony, ale rzadko idealny. Dużo lepiej podać modelowi grafikę z tym kolorem.
Jak zachować tę samą postać lub produkt na wielu grafikach AI?
Nano Banana zmienił sposób pracy ze spójnością. Możesz dostarczyć zdjęcie produktu albo postaci, a następnie rozwijać kolejne obrazy z zachowaniem ich najważniejszych cech.
Przy produkcie zachowujesz obiekt i zmieniasz otoczenie. Przy postaci zachowujesz twarz i sylwetkę, a zmieniasz strój, kadrowanie albo całą scenę. Przygotuj kartę postaci: portret z przodu, z profilu, z trzech czwartych i pełną sylwetkę. Wracasz do niej przy każdym kolejnym ujęciu, a model precyzyjniej trzyma wygląd postaci.
Im prostszy kształt produktu, tym lepszy wynik. Drobne detale, etykiety z małym tekstem czy skomplikowane kształty wymagają więcej iteracji, a czasem ręcznej poprawki. Midjourney odtworzyłby produkt od nowa, więc nie byłby idealnie taki sam - modele kontekstowe mają tu przewagę i pozwalają dorabiać kolejne formaty na social media.
Jak zrobić grafikę AI z tekstem?
Do kreacji produktowych polecam Nano Banana: najlepiej odwzorowuje produkt i radzi sobie z tekstem na obrazie. Żeby tekst wyszedł dokładnie, trzymaj się poniżej 400 słów w całej grafice - więcej tekstu to więcej błędów i zniekształceń. Nano Banana 2 pisze bardzo dobrze, ale nie bezbłędnie.
GPT Image 2 i Seedream 5 również dają dużą kontrolę podczas generowania i edycji.