Fellowi

AI 이미지가 AI처럼 보이는 이유와 그것을 고치는 말

The Fellowi Team 작성 · · 7 분 소요

어둠 속에서 단단한 방향성 빛이 거친 질감의 표면을 스치는 추상 이미지

대개는 알아봅니다. 이미지가 못 만들어져서가 아니라 너무 잘 만들어져서입니다. 피부에 모공이 없고, 얼굴 양쪽이 맞아떨어지고, 빛이 특별히 어디서 오지도 않고, 배경 어디에도 긁힌 자국이 없습니다. 존재하지 않는 장소의 사진처럼 읽히고, 실제로 바로 그것입니다.

원인은 쓸모 있을 만큼 단순합니다. 모델은 잘 찍힌 사진 엄청난 양의 평균을 겨냥하면서, 서로 달랐던 것들을 평균으로 지워버립니다. 그런데 실제 사진끼리 다른 부분이 바로 그 불완전함입니다. 여기 잡티 하나, 저기 단단한 그림자 하나, 한쪽 구석이 무른 렌즈. 그것들을 전부 평균 내면 매끈하고 대칭이고 죽은 것이 나옵니다.

그러니 사실감은 요청해서 얻는 것이 아닙니다. 구체적인 결함을 하나씩 짚어 가며 모델을 끌어내리는 일입니다.

다섯 가지 징후와 각각에 답하는 구절

플라스틱 피부.기본 보정입니다. 인물 데이터는 보정된 얼굴로 가득해서 평균 얼굴에는 모공이 아예 없습니다. 질감을 명시적으로 되돌려 달라고 하세요. “visible skin texture, fine pores, a few freckles across the nose, unretouched”. 불완전함을 주문하는 일은 낯설지만, 생성된 얼굴에 쓸 수 있는 가장 큰 개선입니다.

대칭.실제 얼굴은 대칭이 아니고 실제 방은 가운데 정렬이 아닙니다. 전체의 평균이 대칭인 것은 비대칭이 서로 상쇄되기 때문입니다. 일부러 깨세요. “head turned slightly, weight on one hip, the composition off-centre with more space on her left”.

어디서 오는지 모를 빛. 가장 흔하고 가장 고치기 쉽습니다. 빛이 어디서 오는지 말하지 않으면 모델은 모든 조명 방식을 한꺼번에 평균 내고, 사방으로 부드러운 그림자가 생깁니다. 자연에는 어디에도 없는 상태입니다. 방향을 가진 광원 하나를 지목하면 즉시 해결됩니다.

너무 깔끔한 주변. 실제 방에는 선이 있고 얼룩이 있고 의자 등받이에 겉옷이 걸려 있습니다. 어질러진 것 하나를 지목하는 편이 대상에 관해 한 문장 더 쓰는 것보다 설득력에 크게 작용하고, 가장 값싼 한 마디입니다.

죽은 눈.더 어렵고, 이유를 알아 둘 값어치가 있습니다. 눈이 살아 보이는 것은 캐치라이트, 즉 눈을 비추는 것의 작은 반사 때문입니다. 평균화된 얼굴에는 평균화되고 가운데 있고 대칭인 캐치라이트가 들어가는데, 그것이 마네킹의 눈입니다. 구체적으로 요청하세요. “a single window catchlight in her eyes, slightly off to the left”.

작동하는 광학 용어와 작동하지 않는 용어

카메라 어휘는 물리적 결과를 지목할 때 작동하고, 그저 전문가처럼 들릴 때는 작동하지 않습니다. 이 차이는 익혀 둘 값어치가 있습니다. 사람들이 서로 베껴 쓰는 프롬프트의 절반이 후자이기 때문입니다.

제값을 하는 것: 초점 거리. 배경이 얼마나 들어오고 얼굴이 어떻게 압축되는지를 바꿉니다. 조리개. 어디가 선명한지를 정합니다. 시간대. 지목된 필름이나 색조. 팔레트를 묶습니다. 입자. 비네팅이나 무른 모서리 같은 구체적인 렌즈 결점.

아무것도 못 하는 것:“8k”, “ultra detailed”, “masterpiece”, “award winning”, “professional photography”, “hyperrealistic”. 결과에 대해 어떻게 느끼고 싶은지를 말하는 것이고, 모델은 감상을 그릴 수 없습니다. 더 나쁜 것은, 진짜 구절이 쓸 수 있었을 주의를 차지한다는 점입니다.

쓸모 있는 시험: 그 방에 서 있는 사진가가 이 단어를 따라 움직일 수 있는가. “35mm, 살짝 아래에서”는 실행할 수 있는 지시입니다. “하이퍼리얼”은 아닙니다.

실제 있을 법한 조명 상황을 지목하세요

이 글을 읽고 하나만 바꾼다면 이것으로 하세요. “좋은 빛”도 “시네마틱한 빛”도 아니고, 실제로 일어날 수 있는 상황을.

  • “late afternoon sun through a west-facing window, long shadow across the floor”
  • “overcast noon, flat soft light, no visible shadows”
  • “one bedside lamp to her right, the rest of the room falling into dark”
  • “street lamp overhead at night, hard shadows under the eyes, wet pavement reflecting it”

하나하나가 방향과 단단함과 색을 못박고, 생성물로 읽히게 만드는 “전부 한꺼번에” 느낌을 배제합니다. 붙여 쓰는 프롬프트 의 구절 순서와 같은 원리입니다. 빛은 사람들이 가장 자주 건너뛰는 구절이자 가장 많이 지고 가는 구절입니다.

해상도는 사실감이 아니다

고품질은 더 높은 해상도로 그리고, 그것이 사는 것은 정밀함이지 설득력이 아닙니다. 플라스틱 같은 피부도 1.5K와 똑같이 충실하게 2K로 그려집니다. 픽셀만 더 많아질 뿐입니다. 먼저 스탠더드 40코인으로 프롬프트를 다듬고, 마음에 드는 버전만 크기가 정말 필요할 때 60코인 고품질로 다시 돌리세요. 전체 비교는 품질과 형식에 관한 글 에 있습니다.

정직한 한계 두 가지 더. 손과 얼굴은 가장 어려운 소재입니다. 보는 사람 누구나 전문가여서, 자기도 설명하지 못할 오류를 잡아냅니다. 그리고 여러 이미지에 걸쳐 같은 얼굴이 필요하다면 사실감 어휘를 아무리 쌓아도 되지 않습니다. 그건 참조 이미지의 일이고, 캐릭터 일관성에 관한 글 에 적어 두었습니다. 말은 얼굴을 실어 나르지 못합니다.

사람보다 표면으로 먼저 연습하세요. 천, 낡은 금속, 음식, 젖은 돌. 똑같은 어휘에 반응하고, 특정한 냄비가 어떻게 생겨야 하는지의 전문가는 아무도 없으며, “왼쪽에서 오는 단단한 빛”이 실제로 무엇을 하는지 인물보다 훨씬 빨리 익힙니다. 그다음 Fellowi Images 로 가져가서 한 번에 한 구절씩 바꾸세요. 실패한 생성은 코인이 돌아오므로 실험의 진짜 비용은 일 분입니다.

직접 경험해보세요

따뜻하고 사적인 AI 컴패니언. 7일 무료, 메시지 30개, 카드 불필요.

요금과 한도

계속 읽기