Fellowi

AI 이미지 생성기가 거절하는 이유, 그리고 실제로 벌어지는 일

Fellowi 팀 작성 · · 8 분 소요

어두운 공간에 어긋나게 놓인 반투명 보라색 관문 셋. 뒤로 갈수록 좁아지고 통과하는 사람은 없습니다.

이미지 생성기에서만 생기는 특유의 짜증이 있습니다. 뭔가 써서 보내면 빈손으로 돌아오거나, 무슨 뜻으로든 읽힐 만큼 밍밍한 메시지가 뜹니다. 금지된 걸 요청한 건지, 문장을 잘못 쓴 건지, 버그를 밟은 건지 알 길이 없습니다. 그래서 아무 단어나 바꿔 다시 시도합니다. 가끔 그게 통합니다. 이게 최악의 결과입니다. 사실이 아니라 미신을 배운 셈이니까요.

알아 두면 쓸모 있는 건, “생성기가 거절했다”가 적어도 세 가지 완전히 다른 시스템을 가리킨다는 점입니다. 만든 사람도 이유도 다르고 망가지는 방식도 다릅니다. 구분할 수 있게 되면 수수께끼는 대부분 사라지고, 거절 가운데 상당수는 고칠 수 있는 것으로 드러납니다.

1층: 텍스트 차단 목록

가장 값싼 필터는 아무것도 생성되기 전에 돌아갑니다. 여러분의 글을 읽고 단어와 패턴 목록에 맞춰 보고, 걸리면 그 자리에서 거절합니다. 누른 지 1초 안에 돌아오는 즉각적인 거절이 이 층이고, 어휘를 바꿔 우회하는 데 가장 자주 성공하는 층이기도 합니다.

동시에 가장 거친 층입니다. 차단 목록은 맥락을 읽지 못해서 무해한 작업을 엄청나게 함께 잡습니다. 의학 일러스트의 해부 용어, 어딘가에서 은어가 된 평범한 단어, 엉뚱한 무언가와 겹치는 캐릭터 이름. 정육점이나 인체 드로잉 수업 그림을 뽑아 보려 한 사람은 이 층을 만나 본 적이 있습니다.

알아보는 법은 속도와 일관성입니다. 즉시 거절되고, 매번 똑같은 방식으로 거절된다면 이미지와 상관된 무언가가 아니라 텍스트 필터에 걸린 것이 거의 확실합니다.

2층: 모델 그 자체

2층은 아예 필터가 아닙니다. 그래서 그렇게 이상하게 굴죠. 요즘 이미지 모델은 어떤 출력을 선호하고 어떤 출력은 피하도록 학습됩니다. 그래서 모델이 멀어지도록 훈련된 요청은 거절되는 게 아니라 조용히 나빠집니다. 하나를 요청했는데 그 옆의 것, 더 밋밋하고 더 옷을 입었고 더 모호한 것이 돌아옵니다. 아무것도 자기를 알리지 않습니다. 그냥 더 나쁜 그림이 나왔고, 왜인지는 말할 수 없습니다.

사람들이 “나는 프롬프트를 못 쓴다”고 생각하게 만드는 게 이 층입니다. 어떤 의미에서는 틀리지 않았지만, 문제는 어휘가 아닙니다. 모델이 여러분과 협상하고 있고, 마지막 말은 모델이 합니다.

걷어내기 가장 어려운 층이기도 합니다. 차단 목록은 제공자가 오후 한나절이면 지웁니다. 학습을 되돌리는 건 차원이 다른 문제라서, 정말로 관대한 도구도 가끔 버티고, “검열 없음” 이라는 주장은 꼼꼼히 읽을 가치가 있습니다. 그 말이 정직하게 뜻할 수 있는 범위는 검열 없는 이미지 생성기란 무엇인가 글에 정리했습니다.

3층: 결과를 보는 분류기

3층은 이미지가 생긴 다음에 돌아갑니다. 별도의 모델이 완성된 그림을 보고 점수를 매기고, 점수가 선을 넘으면 전달을 막습니다. 여러분은 렌더링 값을 냈고, 렌더링은 일어났고, 그다음에 다른 무언가가 이건 못 준다고 결정한 겁니다.

이 카테고리에서 가장 사람 미치게 하는 현상을 설명하는 게 바로 이 층입니다. 같은 프롬프트가 화요일엔 되고 목요일엔 안 되는 것. 생성은 무작위입니다. 프롬프트 하나를 두 번 돌리면 이미지 두 장은 서로 다릅니다. 요청이 분류기 기준선 근처에 있다면, 한 장은 통과하고 다른 한 장은 못 합니다. 여러분이 다르게 한 건 없습니다. 주사위가 달랐을 뿐입니다.

어떤 서비스가 밤사이 몰래 필터를 조였다고 확신한 적이 있다면, 대개 벌어진 일은 지금 이야기 쪽입니다. 실제로 조이는 경우도 있습니다. 훨씬 흔한 건, 여러분이 줄곧 경계에 있었고 이틀 연속 반대쪽으로 떨어진 날 그것을 알아챈 경우입니다.

어느 층에 걸렸는지 아무도 알려 주지 않는 이유

구체적인 오류 메시지는 필터 우회 설명서이기 때문입니다. “X라는 단어가 차단되었습니다”라고 말해 주면 무엇을 바꿔야 하는지 정확히 가르쳐 준 셈입니다. 그래서 거의 모든 제공자가 세 원인 모두에 하나의 모호한 거절을 돌려주고, 결과적으로 무해한 프롬프트를 쓴 선량한 사용자가 구멍을 찾는 사람과 똑같이 불투명한 메시지를 받습니다.

방어할 만한 거래이고, 받는 쪽에서는 진심으로 불쾌합니다. 인터넷의 프롬프트 조언 상당수가 민간전승인 이유이기도 합니다. 보이지 않는 시스템을 두고 패턴을 맞춰 보며, 한 번 통했던 의식을 서로에게 전하고 있는 것이죠.

세 층을 모두 견디는 단 하나의 습관

그림에 넣고 싶지 않은 것의 이름은 절대 쓰지 마세요. “누드 없이”라고 쓰면 누드가 프롬프트에 들어가고, 1층이 그걸 잡을 수 있고, 2층이 가중치를 두고, 3층이 결국 그것을 찾게 됩니다. 이미지 모델에는 부정이라는 믿을 만한 개념이 없어서, 부정은 주제로 읽힙니다.

이건 논문이 아니라 저희 시스템 안에서 배웠습니다. 생성마다 앞에 붙이는 지시문의 초기 버전은 특징을 지키려고 그 특징의 이름을 적었고, 사실상 그 사람은 머리가 없다고 말하고 있었습니다. 모델은 그것을 그려야 할 것으로 읽고, 머리가 있는 캐릭터와의 대화에서 대머리 인물을 내놓기 시작했습니다. 해결책은 특징의 값을 아예 적지 않는 것이었습니다. 여기서 따라 나오는 습관 전체는 제대로 그려지는 NSFW 프롬프트 쓰는 법에, 애니 버전은 애니 화풍이 왜 버티는가에 있습니다.

우리는 대신 무엇을 하는가

Fellowi에서 거절되는 것은 둘이고 앞으로도 그렇습니다. 미성년자가 등장하는 성적 표현과 동의 없는 상황의 묘사. 목록은 그게 전부이고, 다이얼이 아니며, 어떤 요금제도 열지 못합니다. 성인 사이의 나머지는 허용됩니다. 그래서 경계를 이렇게 평범하게 말하는 데 아무 비용이 들지 않는 것입니다.

그 둘에 해당하지 않는 모든 것에 대한 설계 원칙은, 실패가 여러분의 비용이 되어서는 안 된다는 것입니다. 프롬프트가 돌아오지 않으면 여러분의 표현을 누그러뜨린 버전으로 한 번 더 시도하고, 그것도 실패하면 코인은 자동으로 지갑에 돌아옵니다. 짐작할 권리에 돈을 내지는 않습니다. 거절 앞에서 다시 쓰는 게 합리적인 대응이 되는 건 오직 이 원칙 때문입니다. 그렇지 않으면 사람들은 아이디어를 아끼며 가장 재미없는 버전부터 시도하게 되죠.

무엇이 마음에 안 드는지 말해 주지 않는 생성기와 싸워 왔다면, 정직한 검증은 하나입니다. 진짜 원했던 것을 요청해 보세요. 생성기를 열거나, 먼저 18+ 생성기 페이지에서 방침을 쉬운 말로 읽어 보세요.

직접 경험해보세요

따뜻하고 사적인 AI 컴패니언. 7일 무료, 메시지 30개, 카드 불필요.

요금과 한도

계속 읽기