Dlaczego twój obraz NSFW z AI wygląda źle i jak to naprawić
Autor: The Fellowi Team · · 9 min czytania

Ten tekst jest na czas po kliknięciu. Prompt napisany, monety wydane, a to, co wróciło, jest złe w sposób, który widać, ale trudno nazwać: skóra wygląda jak u manekina z wystawy, dłoń ma jeden staw za dużo, kobieta z poprzedniego obrazu nagle jest kimś innym. Jak w ogóle napisać prompt, opisujemy osobno, w artykule jak pisać prompty do generowania postaci, które naprawdę się renderują. Ten zaczyna od obrazu i idzie wstecz.
Każda sekcja to jeden objaw, jego najbardziej prawdopodobna przyczyna i poprawka, którą spróbowalibyśmy najpierw. Większość nieudanych renderów ma jedną przyczynę, nie pięć, więc znajdź pasujący objaw, a resztę pomiń.
Skóra jak plastik albo wosk
Objaw. Skóra jest gładka, błyszcząca i bez porów, jak u wypolerowanej lalki albo w mocno wyretuszowanej reklamie, a całe ciało ma ten sam równy połysk.
Prawdopodobna przyczyna. Prompt o to poprosił, choć nie chciał. Słowa w rodzaju flawless, perfect skin, gładka czy masterpiece ciągną w stronę najbardziej wyretuszowanego końca wszystkiego, co model widział, a miękkie światło z przodu usuwa cienie, dzięki którym skóra wygląda jak skóra. Jeśli ulepszanie promptu było włączone, wersja, z której powstał obraz, może zawierać połysk, którego nigdy nie napisałeś.
Co zrobić. Usuń wszystkie komplementy i zamiast tego opisz fakturę: widoczne pory, kilka piegów na ramionach, delikatne włoski na przedramieniu, zmarszczkę w zgięciu łokcia. Nadaj światłu kierunek, jedno okno z boku albo nisko ustawioną lampę, żeby pojawiły się cienie modelujące ciało. Kontekst w rodzaju „spontaniczne zdjęcie z telefonu” albo „film 35 mm, lekkie ziarno” ciągnie ku prawdziwym fotografiom zamiast reklamom. Wyższa jakość dodaje szczegółów, ale dodaje je do tej powierzchni, którą dostała; kiedy warto za nią zapłacić, omawia jakość Standard czy High.
Dłonie, kończyny i anatomia, które się nie zgadzają
Objaw. Sześć palców, nadgarstek zgięty w złą stronę, noga, która nie należy do nikogo, dwa ciała zlewające się tam, gdzie się dotykają.
Prawdopodobna przyczyna. Dłonie są małe, nieskończenie zmienne i często częściowo zasłonięte, więc modele wciąż mylą się przy nich częściej niż przy czymkolwiek innym. Każdy punkt styku między dwiema osobami mnoży problem: splecione palce, ręka na talii, nogi na nogach. Im więcej kończyn styka się w jednym kadrze, tym więcej okazji, by któraś poszła nie tak.
Co zrobić. Daj każdej dłoni jedno zadanie, które da się nazwać: trzyma kieliszek, leży płasko na prześcieradle, odgarnia włosy. Ogranicz punkty styku, zwłaszcza przy dwóch osobach, i odsuń trochę kamerę. Nie pisz „idealne dłonie” ani „pięć palców”; jak przy każdym zaprzeczeniu, nazwanie problemu wstawia go do kadru. I zanim cokolwiek przepiszesz, wygeneruj raz ponownie. Generowanie jest losowe, a dłoń, która zepsuła się w jednym renderze, w następnym często jest w porządku.
Kadr ucina nie to, co trzeba
Objaw. Stopy ucięte w kostce, czubek głowy obcięty, leżąca postać wciśnięta w pionowy kadr z pustą podłogą nad nią i pod nią.
Prawdopodobna przyczyna. Format nie pasował do pozy. Kwadrat nie zmieści stojącej postaci w całości bez jej pomniejszenia, a pionowy kadr marnuje miejsce wokół osoby leżącej. W trybie auto format wybiera model, a gdy dołączysz zdjęcia referencyjne, kadruje wynik według pierwszego z nich, więc zbliżenie twarzy na pierwszym miejscu ciągnie nowy obraz ku zbliżeniu. Jeden model na liście w ogóle nie daje wyboru formatu.
Co zrobić. Wybierz format, zanim napiszesz prompt: pionowy do stojącej pozy w całej postaci, poziomy do leżącej postaci albo dwóch osób obok siebie, kwadrat do portretu od piersi w górę. Potem nazwij kadr także słowami: cała postać, od kolan, głowa i ramiona. Z referencjami ustaw jako pierwszą tę, której kadrowanie chcesz. Jeśli potrzebujesz konkretnego formatu, wybierz model, który ma wybór formatu. Więcej w tekście najpierw wybierz format.
Twarz zmienia się z obrazu na obraz
Objaw. Ten sam prompt, ten sam opis, a każdy obraz pokazuje trochę inną kobietę: zmienia się linia żuchwy, oczy rozsuwają się szerzej, wiek przesuwa się o kilka lat.
Prawdopodobna przyczyna. Tekst nie uniesie twarzy. „Zielone oczy, piegi, ciemne falowane włosy” pasuje do milionów ludzi, a każdy render wybiera kogoś nowego. Więcej opisu zawęża tłum, ale nigdy nie sprowadza go do jednej osoby.
Co zrobić. Użyj obrazu referencyjnego, własnego przesłanego zdjęcia albo obrazu jednej z naszych wyselekcjonowanych pełnoletnich towarzyszek, i trzymaj ten sam na pierwszym miejscu przez całą serię. Prompt pisz wtedy o wszystkim innym: pokój, światło, poza, ubranie. W wideo zaczynaj klip od kadru, który już ci się podoba, a nie od samego tekstu, żeby twarz była ustalona, zanim cokolwiek się poruszy. Każda referencja trochę podnosi cenę (stawki są na stronie produktu), a model bez wyboru formatu nie przyjmuje referencji. Dłuższa wersja: jak utrzymać spójną postać.
Wyszło grzeczniej, niż prosiłeś
Objaw. Prosiłeś o scenę nago, a dostałeś bieliznę. Prosiłeś o łóżko, a dostałeś kanapę, na której wszyscy siedzą prosto. Obraz jest w porządku, tylko bardziej ubrany i bardziej uprzejmy niż twoje słowa.
Prawdopodobna przyczyna. Dwie różne rzeczy i warto wiedzieć, która. Pierwsza to sam model: modele obrazów są trenowane, by unikać niektórych próśb, i zamiast odmówić, po cichu dryfują ku czemuś bardziej mdłemu. Druga to nasze własne powtórzenie. Gdy pierwsza próba się nie uda, próbujemy jeszcze raz przed zwrotem, a ta druga próba wysyła twój prompt bez krótkiej listy dosadnych etykiet, słów takich jak „explicit” czy „naked”. Jeśli obraz przyszedł po tym powtórzeniu, powstał z łagodniejszego sformułowania, niż napisałeś. Mówi o tym też nasz regulamin; powtórzenie istnieje po to, żeby potknięcie na jednym granicznym słowie nie kończyło się niczym.
Co zrobić. Opisz obraz zamiast go etykietować. „Explicit” i podobne etykiety to oceny obrazu, a nie obraz: model nic z nich nie narysuje, a to pierwsze słowa, które powtórzenie usuwa. Zwykły opis tego, co widać, gdzie jest osoba i co robi światło, zostawia powtórzeniu niewiele do wycięcia i daje modelowi coś do narysowania. Ulepszanie promptu niczego tu nie zmienia: dodaje szczegóły, nie pozwolenie. W wideo klip odrzucony z powodu treści w ogóle nie jest powtarzany łagodniejszymi słowami: po prostu kończy się błędem, a monety wracają.
Za dużo szczegółów walczy ze sobą
Objaw. Obraz jest jednocześnie przeładowany i rozmyty. Strój składa się z połówek dwóch strojów, światło pada z trzech stron, styl utknął gdzieś między anime a fotografią.
Prawdopodobna przyczyna. Prompt, który rósł przez dopisywanie. Każda nowa fraza to kolejny warunek, który model próbuje spełnić, a gdy dwa są sprzeczne, uśrednia je. Czterdzieści przymiotników nie kupuje czterdziestu szczegółów; kupuje kompromis między nimi wszystkimi.
Co zrobić. Skróć do jednego tematu, jednego miejsca, jednego światła i jednego stylu, a potem przeczytaj resztę na głos. Dwa stroje albo dwa nastroje to dwa obrazy. Gdy prompt robi się coraz dłuższy, a wynik coraz gorszy, zwykle pomaga skasować połowę; jeden obraz, dwanaście prób pokazuje ten moment szczegółowo, łącznie z próbami, które były czystą stratą.
Wideo, które się odkształca albo topi w połowie ruchu
Objaw. Pierwsza sekunda jest w porządku, a potem dłoń rozpuszcza się w prześcieradle, jedna twarz przechodzi w inną, materiał przenika przez skórę albo ciało wygina się tak, jak nie wygina się żadne ciało.
Prawdopodobna przyczyna. Więcej ruchu, niż klip jest w stanie unieść. Kilka czynności w jednym klipie, kamera, która rusza się, gdy rusza się też postać, albo prompt opisujący scenę zamiast ruchu zmuszają model do wymyślania klatek między stanami, których nie umie pogodzić. Kadr startowy z lekko zepsutą dłonią przekazuje tę dłoń dalej, a ruch ją pogarsza. Format inny niż w obrazie startowym dokłada do tego wszystkiego jeszcze przekadrowanie.
Co zrobić. Zacznij od sprawdzonego już kadru z czystymi dłońmi i wyraźną pozą. Proś o jeden ruch na klip, mały i powolny: odwraca głowę w stronę okna, prześcieradło zsuwa się z ramienia. Niech rusza się albo kamera, albo postać, nie obie naraz. Zostaw format na auto, żeby klip zachował kadrowanie obrazu startowego, a jeśli wiesz, gdzie ruch ma się skończyć, dodaj kadr końcowy, żeby model nie musiał zgadywać. Testuj krótkim klipem w niższej rozdzielczości, zanim zapłacisz za długi, bo cena zależy od długości i rozdzielczości. Kiedy będziesz gotowy, otwórz studio wideo.
Typowy „wygląd AI”
Objaw. Technicznie poprawne i od razu rozpoznawalne jako wygenerowane: wyśrodkowane, symetryczne, błyszczące, złote światło, twarz piękna tak, jak piękne są zdjęcia stockowe.
Prawdopodobna przyczyna. Każdą decyzję, której nie podjąłeś, podjęła średnia. Niepodana pora dnia staje się złotą godziną, niepodany kadr staje się wyśrodkowany i frontalny, niepodana skóra staje się wyretuszowana.
Co zrobić. Podejmij decyzje sam. Wybierz prawdziwą, mało pochlebną porę, pochmurne południe albo pokój oświetlony jedną lampką nocną. Przesuń postać poza środek. Dodaj jeden zwyczajny przedmiot, który pasuje do zamieszkanego pokoju: kabel od ładowarki, zmiętą kołdrę, kubek na podłodze. Drobne niedoskonałości to najtańszy realizm, jaki istnieje. Jeśli utknąłeś, jeden render jednozdaniowego pomysłu z włączonym ulepszaniem promptu pokaże, jakie szczegóły dodaje pełniejszy opis; zostaw te, które ci się podobają, przepisz je własnymi słowami i znów wyłącz ulepszanie, jak w tekście kiedy pozwolić AI przepisać prompt.
Strategia ponawiania, która nie pali monet
- Wygeneruj raz ponownie, zanim zaczniesz poprawiać. Sam przypadek zmienia dłonie, twarze i kadry. Jeśli drugi render jest dobry, prompt też był.
- Zmieniaj jedną rzecz naraz. Format albo światło albo jedną frazę, nigdy trzy. Jeśli zmienisz trzy i jest lepiej, nie nauczyłeś się niczego, co da się powtórzyć.
- Wyłącz ulepszanie promptu na czas dopracowywania. Przepisany tekst, którego nie możesz przeczytać, to druga zmienna, nad którą nie panujesz.
- Zapisuj to, co zadziałało. Fraza o świetle albo kadrze, której jeszcze użyjesz, należy do prostej biblioteki promptów, a nie do historii, którą trzeba przewijać.
- Zatrzymaj się po kilku pudłach przy tym samym objawie. Wróć na górę tej strony. Przyczyną jest zwykle format, referencja albo długość promptu, a nie to jedno słowo, które ciągle podmieniasz.
Ile kosztuje nieudany render
Nic. Jeśli obraz albo klip się nie uda, czy to przez odmowę, wygasłe już zdjęcie referencyjne, czy przeciążony model, monety wracają do portfela w całości i automatycznie, bez żadnego wniosku. Render, który po prostu trwa długo, nie jest wyrzucany: czekamy na niego dalej i zwracamy monety, jeśli nigdy nie dotrze. Złagodzone powtórzenie też jest objęte. Jeśli i druga próba się nie uda, nic nie płacisz.
Uczciwa druga strona: render, który się zakończył, jest płatny, czy ci się podoba, czy nie. Woskowa twarz albo szósty palec to gotowy obraz, nie błąd. Dlatego diagnoza powyżej ma znaczenie. Zwrot chroni przed błędami, a nie przed promptem, któremu brakowało jeszcze jednej poprawki. Aktualne ceny są na stronie produktu.
Czego nie wyleczy żadna poprawka
Niektóre rzeczy wciąż się nie udają, cokolwiek zrobisz. Dłonie w splątanych pozach we dwoje psują się częściej, niż powinny. Podobieństwo dryfuje, gdy poza albo kąt są daleko od referencji. Długie klipy ze skomplikowanym ruchem dwóch osób wciąż się rozpadają. A niektórym prośbom model się opiera, jakkolwiek je sformułować; gdy trzy naprawdę różne podejścia wracają równie grzeczne, granica leży w modelu, nie w twoim prompcie, a kolejne przeformułowania dają tylko kolejne prawie-trafienia.
Dwie rzeczy w ogóle nie są kwestią promptu. Wszystko, co seksualne z udziałem nieletnich, i wszystko, co przedstawia brak zgody, jest w Fellowi odrzucane na stałe. Żadne sformułowanie, żadne powtórzenie i żaden plan tego nie zmieni.
Na całą resztę: znajdź objaw, który widzisz, zmień tę jedną rzecz, którą wskazuje jego poprawka, i wygeneruj ponownie w studiu obrazów.
Pytania, na które odpowiada ten artykuł
Dlaczego mój obraz postaci z AI jest mniej odważny, niż prosiłem?
Często sam model bez słowa skręca ku czemuś grzeczniejszemu. W Fellowi nieudana pierwsza próba jest powtarzana raz bez kilku dosadnych etykiet, więc obraz, który przyszedł po takim powtórzeniu, powstał z łagodniejszego sformułowania niż twoje.
Czy płacę za nieudane generowanie postaci?
Nie. Gdy obraz albo klip się nie uda, monety wracają do portfela automatycznie i w całości; płacisz tylko za render, który faktycznie się zakończył, niezależnie od tego, czy ci się podoba.
Jak sprawić, żeby twarz nie zmieniała się między obrazami AI?
Użyj obrazu referencyjnego zamiast dłuższego opisu, bo tekst nie utrzyma jednej twarzy między renderami. Trzymaj tę samą referencję na pierwszym miejscu przez całą serię, ponieważ przy automatycznym formacie kadr też podąża za tym pierwszym obrazem.
Czytaj dalej

Słownik generowania AI NSFW: każde pojęcie przed pierwszym obrazem
Można zacząć bez czytania instrukcji. Oto słowa na elementach sterujących wokół pola promptu, każde wyjaśnione na jednym oddechu, z artykułem, który rozwija temat.

NSFW AI: sceny i scenografia. Najpierw urządź pokój, potem ustaw światło
Przed światłem, strojem i pozą jest pokój. Spacer scenografa po czterech urządzonych wnętrzach, rekwizyty, które zasłużyły na swoje miejsce, i zdanie, które nie pozwala scenografii się rozjechać.

Style sztuki AI NSFW: przewodnik od fotorealizmu po pin-up
Pięć stylów dla obrazów AI dla dorosłych, słownictwo, które kieruje model ku każdemu z nich, po jednym sugestywnym przykładzie promptu i sposób na utrzymanie całej serii w jednym stylu.