Kawiarnia w stylu sportowym: dlaczego światło i materiał gryzą się ze sobą
Ta sceneria łączy dwa problemy naraz. Po pierwsze mieszane źródła światła — zimne światło dzienne z okna i ciepłe, punktowe światło lamp nad barem tworzą dwa różne kierunki cieni i dwie różne temperatury barwowe na jednej twarzy. Model AI często "nie wie", które źródło ma dominować, i w efekcie skóra ma nienaturalny, dwubarwny odcień, a odbicia w szklankach czy filiżankach są przypadkowe i nie pasują do żadnego z realnych świateł w kadrze. Po drugie strój sportowy — legginsy, top kompresyjny, dopasowana bluza — nie ma fałd, które maskują błędy w proporcjach. Każde zgięcie kolana, łokcia czy nadgarstka jest widoczne gołym okiem, więc błędy anatomiczne (zbyt długie przedramię, dziwnie wygięty staw) rzucają się w oczy dużo szybciej niż przy luźnej sukience.
photo of a young woman in a fitted athletic outfit (cropped top, leggings) sitting at a wooden cafe table by a large window, holding a ceramic cup with both hands, soft daylight from window mixed with warm interior lamp light, natural skin texture, relaxed candid pose, shallow depth of field, shot on 50mm lens, realistic reflections in cup and glass
extra fingers, fused fingers, distorted hand, warped elbow, mismatched skin tone, double shadow, overexposed window, harsh flash, plastic skin, blurry reflection, wrong perspective on cup, deformed limb, unnatural joint bend, oversaturated colors
Poszczególne fragmenty promptu mają konkretne zadania. Fraza "soft daylight from window mixed with warm interior lamp light" mówi modelowi, że ma pogodzić dwa źródła, zamiast losowo wybrać jedno — to kluczowe zdanie, którego nie warto usuwać. "holding a ceramic cup with both hands" ogranicza liczbę możliwych układów palców i zmniejsza ryzyko błędów w dłoniach, bo model ma mniej swobody w ułożeniu rąk. "shot on 50mm lens" i "shallow depth of field" odpowiadają za rozmycie tła, co jest szczególnie przydatne w kawiarni, bo maskuje niedoróbki w dalszych planach — meble, inne postaci, napisy na szybach. Chcąc zmienić wariant, podmień typ napoju (np. "iced coffee in a glass" zamiast filiżanki — wtedy w negative prompt warto dodać "cracked glass, floating ice cubes" jako dodatkowe zabezpieczenie), porę dnia ("golden hour light through window" da cieplejszy, bardziej jednolity kolor i mniej problemów z mieszanym światłem) albo typ stroju sportowego (zamiana legginsów na luźniejsze spodnie dresowe od razu zmniejsza ryzyko widocznych błędów anatomii, kosztem mniej "sportowego" charakteru zdjęcia).
Najczęstszy błąd: szklane odbicia i dłonie w jednym kadrze
Najczęściej powtarzający się problem w tej scenerii to połączenie błędu w dłoniach z nierealistycznym odbiciem w naczyniu — model generuje palec, który wnika w filiżankę, albo odbicie w szkle, które nie odpowiada żadnemu światłu z otoczenia. Dzieje się tak, bo dłonie trzymające przezroczysty lub półprzezroczysty przedmiot to jedno z najtrudniejszych zadań geometrycznych dla generatora — musi jednocześnie policzyć palce, kąt nadgarstka i załamanie światła w szkle. Najprostsza naprawa to zmiana ujęcia: zamiast obu dłoni na filiżance, poproś o "one hand resting on the table next to the cup" — jedna dłoń w spoczynku generuje się dużo stabilniej niż dwie dłonie w akcji. Jeśli zależy Ci akurat na ujęciu z filiżanką w dłoniach, wygeneruj kilka wariantów i wybierz ten, w którym liczba palców i kąt nadgarstka są poprawne — przy tej scenerii selekcja z kilku wersji często jest szybsza niż próba "wymuszenia" poprawnej anatomii samym promptem.
