텍스트로 영상 만들기 vs 이미지로 영상 만들기: 무엇을 골라야 하나
The Fellowi Team 작성 · · 6 분 소요

Fellowi에는 영상 모델이 네 개 있습니다. 둘은 문장에서 시작하고 둘은 그림에서 시작하며, 각 쌍마다 빠른 터보 버전과 느린 풀 버전이 있습니다. 이것이 카탈로그 전부이고, 돌아오는 결과를 실제로 바꾸는 선택은 첫 번째 하나뿐입니다. 모델에게 정지 이미지를 건넬 것인가, 설명을 건넬 것인가.
인정할 것이 하나 있습니다. 한동안 저희는 이것을 잘못 설명했습니다. 이 블로그의 세 글이 텍스트만으로 가는 길은 없다고 단정해서 적었는데, 사실이 아니었고 이미 수정했습니다. 9월 초에 여기서 이미지에서 영상으로 가는 길이 유일하다고 읽으셨다면, 그것이 저희가 고친 문장입니다.
대부분의 경우를 정리하는 한 가지 규칙
특정한 얼굴이 끝에 나와야 한다면 이미지에서 시작하세요.
이것은 취향 문제가 아닙니다. 글로 된 설명은 얼굴을 실어 나르지 못합니다. “20대 후반 여성, 짙은 머리, 초록 눈”은 범주를 조금 좁힐 뿐 그 안에 수천 개의 얼굴을 남기고, 모델은 실행할 때마다 다른 하나를 고릅니다. 정지 이미지를 건네면 추측이 통째로 사라집니다. 화면에 누가 있는지는 이미 정해졌고, 모델의 일은 그 사람을 움직이는 것으로 줄어듭니다. 왜 정체성이 참조 이미지에 깃드는지 는 따로 썼는데, 영상은 그 문제의 가장 날카로운 형태입니다. 초당 스물네 장에 걸친 불일치는 별개의 그림 두 장 사이의 불일치보다 훨씬 잘 보입니다.
텍스트로 만드는 쪽이 제값을 하는 때는 대상이 일반적이고 장면이 주인공일 때입니다. 방파제에 부딪치는 파도, 밤의 차량 흐름, 타들어 가는 초, 거리의 설정 숏. 그것이 “어떻게 보여야 하는지” 아는 관객이 없으니 어긋날 상대도 없고, 정지 이미지를 만드는 단계를 통째로 건너뜁니다.
각 경로가 요구하는 것
텍스트로 만들기 는 세계를 통째로 지고 갈 프롬프트를 원합니다. 대상, 장소, 빛, 카메라, 그리고 움직임. 아무것도 대신 고정되어 있지 않기 때문에 쓰기가 더 어렵고, 두루뭉술하게 쓰면 평균적이고 스톡 영상 같은 클립이 돌아옵니다.
이미지로 만들기 는 거의 반대를 원합니다. 장면이 어떻게 생겼는지는 정지 이미지가 이미 말했으므로 그것을 프롬프트에서 되풀이하는 것은 낭비이고, 이미지와 모순되게 쓰는 것은 낭비보다 나쁩니다. 모든 단어를 움직임에 쓰세요. 무엇이 움직이고 얼마나 빠르며 카메라가 무엇을 하는지. 저희 영상 프롬프트 가이드 가 바로 그 규율을 중심으로 짜여 있고, 붙여 쓰는 프롬프트 모음 중 하나는 좋은 시작 프레임이 되도록 일부러 그렇게 썼습니다.
이미지 경로에는 텍스트 경로가 못 하는 세 번째 기능이 있습니다. 시작 프레임과 함께 종료 프레임 을 받는 것입니다. 둘 다 주면 직접 고른 두 정지 이미지 사이의 움직임을 만들어 줍니다. 여기서 얻을 수 있는 가장 강한 제어이며, 어디서 끝나야 하는지 정확히 아는 짧은 세로 영상에는 자연스러운 도구입니다.
터보냐 풀이냐는 별개의 문제
경로를 골랐어도 계열은 따로 고릅니다. 이쪽은 발상의 충실도가 아니라 상한과 가격의 이야기입니다.
터보 는 빠르고 싼 두 개입니다. 720p와 1080p를 제공하고 720p 4초가 500코인. 풀 모델 둘은 더 느리지만 더 멀리 갑니다. 아래로 480p, 위로 4K가 더해지고 같은 720p도 눈에 띄게 좋아서, 같은 4초가 500이 아니라 900코인입니다. 해상도가 올라갈수록 격차는 빠르게 벌어집니다. 가격이 초당이고 4K는 픽셀 수가 압도적이기 때문입니다. 풀 4K는 4초에 4,400코인, 30초면 33,000코인입니다.
솔직한 조언은 초안을 터보로 만들라는 것입니다. 720p 500코인으로 움직임과 화각을 잡고, 그다음에 이 클립이 풀 모델을 받을 값어치가 있는지 판단하세요. 전부 초당 가격이므로, “카메라 움직임을 다르게 했어야 했다”를 깨닫는 대가는 어느 모델에서 깨달았느냐로 정해집니다.
두 경로가 공유하는 설정
길이는 4초에서 30초. 화면비는 일곱 가지이며 세로형 소셜 영상 을 위한 9:16도 있고, 형태를 강요하지 않고 시작 이미지의 화각을 그대로 지키는 자동 설정도 있습니다. 음성은 체크박스이고 클립과 함께 생성되며 가격을 바꾸지 않습니다. 각 조절 항목은 조작 화면에 대한 글 에 더 자세히 있습니다.
가격에 대한 실무적인 메모 하나. 비용은 길이에 비례하고 모델과 해상도로 정해지므로, 어느 경로로 들어왔든 동일합니다. 텍스트 쪽을 고른다고 아껴지지 않고, 이미지 쪽을 고른다고 더 들지 않습니다. 내용으로 고르세요.
실패한 생성은 코인이 자동으로 돌아옵니다. 그러니 먼저 돌릴 값어치가 있는 것은 싼 실험입니다. Fellowi Images 에서 40코인으로 정지 이미지를 만들고, Fellowi Video 로 가져가 움직임만 적으세요. 소재에 얼굴이 애초에 필요 없었다는 것을 알게 된다면, 한 단계를 건너뛸 수 있었다는 사실을 배운 셈이고, 그건 싼 수업료입니다.