Co to jest
Rozdzielczość bazowa to natywny, oryginalny rozmiar pikseli, w którym model sztucznej inteligencji był trenowany. Mówimy tutaj o modelach generatywnych — tych, które tworzą obrazy na podstawie tekstowych opisów. Model uczy się rozpoznawać i reprodukować cechy (tekstury, kształty, detale) właśnie w tej konkretnej rozdzielczości, nie w innej.
Jeśli model był trenowany na obrazach 512×512 pikseli, to jest jego rozdzielczość bazowa. To znaczy, że sieć neuronowa została wyposażona w konkretną liczbę parametrów i warstw, które współpracują optymalnie dla tego rozmiaru. Można oczywiście generować w innych rozdzielczościach — większych czy mniejszych — ale wymaga to dodatkowych operacji skalowania, co wpływa na wynik.
Do czego służy przy modelkach AI
Rozdzielczość bazowa ma bezpośredni wpływ na jakość Twojej wirtualnej modelki. Im wyższa rozdzielczość bazowa modelu, tym więcej detali może on uchwycić w wygenerowanej twarzy, ciele i ubraniu. Model trenowany na 768×768 będzie w stanie wygenerować bardziej wyraziste i precyzyjne elementy (pory na skórze, tekstura włosów, rysy twarzy) niż model pracujący natywnie na 512×512.
Kiedy generujesz zdjęcie modelki, uruchamiasz proces w rozdzielczości bazowej, a następnie możesz je powiększyć algorytmem upscalingu. Jednak to powiększenie to dodatkowy krok — oryginalny obraz wychodzi z modelu już w jego natywnym rozmiarze. Dlatego warto wiedzieć, jaka jest rozdzielczość bazowa modelu, którym się posługujesz.
Typowe wartości i ustawienia
Większość popularnych modeli generatywnych pracuje natywnie na rozdzielczościach od 512×512 do 1024×1024 pikseli. Nowsze modele przesuwają się w stronę wyższych rozdzielczości, ale zawsze istnieje punkt, w którym model pracuje najstabilniej.
W praktyce: jeśli generator oferuje opcję wyboru rozdzielczości, wybierz tę równą lub bliską rozdzielczości bazowej — wygenerowana modelka będzie wtedy najlepsza jakościowo. Jeśli musisz pracować w wyższej rozdzielczości, później używasz upscalingu (osobnego narzędzia, które powiększa obraz), ale to dodaje czas i koszty zasobów.
Najczęstszy błąd
Ludzie często myślą, że mogą generować w dowolnie wysokiej rozdzielczości bez konsekwencji. W rzeczywistości jeśli rozdzielczość generowania jest daleko od rozdzielczości bazowej modelu, mogą pojawić się artefakty — dziwne zniekształcenia, asymetrie czy fragmenty, które wyglądają niepoprawnie. Model zostaje zmuszony do ekstrapolacji, czyli wymyślania pikseli, zamiast pracować naturalnie.
Rozwiązanie: zawsze sprawdź dokumentację modelu, żeby wiedzieć, jaka jest jego rozdzielczość bazowa, i generuj w tej rozdzielczości lub tuż przy niej. Dopiero potem, jeśli potrzebujesz większego formatu, użyj dedykowanego upscalera.