Fellowi

Varför AI-bildgeneratorer nekar dig, och vad som faktiskt händer

Av Fellowi-teamet · · 8 min läsning

Tre genomskinliga violetta portar förskjutna över ett mörkt fält, var och en smalare än den förra, utan någon som passerar.

Det finns en sorts frustration som bara uppstår med bildgeneratorer. Du skriver något, det kommer tillbaka tomt eller med ett meddelande så intetsägande att det kan betyda vad som helst, och du har ingen aning om du bad om något förbjudet, formulerade dig illa eller sprang på en bugg. Så du byter ett ord på måfå och försöker igen. Ibland funkar det, vilket är det sämsta tänkbara utfallet, för du har just lärt dig en vidskepelse i stället för ett faktum.

Det nyttiga att förstå är att ”generatorn nekade mig” beskriver minst tre helt olika system, byggda av olika människor av olika skäl, som fallerar på olika sätt. När du kan skilja dem åt försvinner det mesta av mysteriet, och en hel del avslag visar sig gå att åtgärda.

Lager ett: ordlistan

Det billigaste filtret körs innan något genereras. Det läser din text, jämför den med en lista av ord och mönster och avvisar direkt vid träff. Det är det här lagret som ger omedelbara avslag, oftast inom en sekund efter klicket, och det är det man oftast tar sig runt genom att byta ordval.

Det är också det trubbigaste. Ordlistor läser ingen kontext och fångar därför enorma mängder fullt oskyldigt arbete: anatomiska termer i en medicinsk illustration, vanliga ord som är slang någon annanstans, karaktärsnamn som krockar med något orelaterat. Den som försökt generera en charkbutik eller en kroki-lektion har mött det här lagret.

Kännetecknet är hastighet och konsekvens. Avvisas en prompt omedelbart och avvisas varje gång på exakt samma sätt, då hänger du nästan säkert på ett textfilter och inte på något som har med bilden att göra.

Lager två: själva modellen

Det andra lagret är inget filter alls, vilket är därför det beter sig så märkligt. Dagens bildmodeller tränas med preferens för vissa utdata och emot andra, så en begäran modellen styrts bort från avvisas inte, den försämras tyst. Du bad om en sak och fick grannsaken: blekare, mer påklädd, mer tvetydig. Ingenting anmälde sig. Du fick bara en sämre bild och kunde inte säga varför.

Det är det här lagret som får folk att tro att de är dåliga på att skriva prompter. På sätt och vis har de inte fel, men problemet är inte deras ordförråd. Modellen förhandlar med dem och har sista ordet.

Det är också svårast att ta bort. En leverantör raderar en ordlista på en eftermiddag. Att backa träning är en annan storleksordning, och därför spjärnar även genuint tillåtande verktyg emot ibland, och därför är ordet ocensurerat värt att läsa noga. Vad det ärligt kan betyda står i vad en ocensurerad bildgenerator faktiskt betyder.

Lager tre: klassificeraren som tittar på resultatet

Tredje lagret körs efter att bilden finns. En separat modell tittar på den färdiga bilden, poängsätter den och blockerar leveransen om poängen passerar en gräns. Du betalade för renderingen, renderingen skedde, och sedan bestämde något annat att du inte fick den.

Det här lagret förklarar det mest vansinniga beteendet i hela kategorin: samma prompt som funkar på tisdag och faller på torsdag. Generering är slumpmässig. Kör en prompt två gånger så får du två olika bilder. Ligger din begäran nära klassificerarens tröskel tar sig den ena förbi och den andra inte. Du gjorde inget annorlunda. Tärningen gjorde det.

Om du någon gång varit övertygad om att en tjänst i tysthet skruvade åt filtren över natten är det oftast detta som hänt i stället. Ibland skruvar leverantörer verkligen åt. Betydligt oftare låg du alltid på kanten och märkte det den dag du landade fel två gånger i rad.

Varför ingen berättar vilket lager som tog dig

För att ett specifikt felmeddelande är en bruksanvisning för att ta sig förbi filtret. Säg åt någon att ”ordet X blockerades” och du har lärt dem exakt vad de ska byta ut. Nästan alla leverantörer returnerar därför ett enda vagt avslag för alla tre orsakerna, och resultatet är att en hederlig användare med en harmlös prompt får samma ogenomträngliga meddelande som någon som letar hål.

Det är en försvarbar avvägning och genuint obehaglig att befinna sig i mottagarändan av. Det förklarar också varför så mycket promptråd på nätet är folktro: människor mönstermatchar mot ett osynligt system och för vidare ritualer som råkade fungera en gång.

Den enda vana som överlever alla tre lagren

Nämn aldrig något du inte vill ha med i bilden. ”Ingen nakenhet” sätter nakenhet i prompten, där lager ett kan matcha den, lager två väger den och lager tre till slut letar efter den. Bildmodeller har inget pålitligt begrepp om negation, så ett negativ läses som ett ämne.

Vi lärde oss det i vårt eget system, inte ur en artikel. En tidig version av instruktionen vi lägger före varje generering namngav ett fysiskt drag för att bevara det, och sa i praktiken att personen var skallig. Modellen läste det som något att rita och började leverera skalliga personer i chattar med figurer som har hår. Lösningen var att sluta namnge egenskapsvärden helt. Hela uppsättningen vanor som följer står i skriva NSFW-prompter som faktiskt blir en bild, och animeversionen i varför animestilen bjuder motstånd.

Vad vi gör i stället

Två saker avvisas hos Fellowi och kommer att fortsätta göra det: allt sexuellt som rör minderåriga, och varje skildring av bristande samtycke. Det är hela listan, det är inget reglage och ingen prisplan öppnar det. Allt annat mellan vuxna är tillåtet, och just därför kostar det oss ingenting att säga gränserna så rakt ut.

För allt som inte är någon av de två gäller principen att ett misslyckande aldrig ska kosta dig något. Kommer en prompt inte tillbaka provar vi en gång med en mildare version av dina egna ord, och misslyckas även den återgår mynten automatiskt till plånboken. Du betalar inte för rätten att gissa. Just den regeln gör omskrivning till det rationella svaret på ett avslag, i stället för att spara på idéerna och prova den tråkigaste versionen av varje.

Har du slagits med en generator som vägrar säga vad den invänder mot är det ärliga testet att be om det du faktiskt ville ha: öppna generatorn, eller läs först vår policy i klartext på sidan för 18+ generatorn.

Testa själv

En varm, privat AI-följeslagare: 7 dagar gratis med 30 meddelanden, utan kort.

Priser och gränser

Läs vidare