클로즈업을 이해하지 못하는 AI
클로즈업 컷 몇 장 만들려다가, 신발이 매번 다른 신발이 됐다
지난 글에서 캐릭터 얼굴/의상은 어느 정도 고정하는 법을 익혔다고 썼는데, 이번엔 그보다 한 단계 더 어려운 문제에 부딪혔다. 장면 중간에 들어갈 소품 클로즈업(신발, 샴페인 자국, 레드컵 같은 것들)을 몇 장 만들려다가, 디테일이 매번 제멋대로 바뀌는 걸 겪었다.
소품만 따로 찍어달라고 하면 배경이 사라진다
"벨라가 벗어둔 신발을 클로즈업으로 보여줘"라고 요청했더니, 결과물엔 신발만 덩그러니 있고 방 배경 자체가 통째로 사라져 있었다. 책장도, 러그도, 소파 다리도 다 없어지고 그냥 텅 빈 배경에 신발만 놓인 정물 사진처럼 나왔다. 이건 그 장면의 일부를 확대한 게 아니라, 완전히 새로 만든 독립된 사진이었다.
신발 자체도 매번 다른 신발이었다
더 큰 문제는 신발 디테일이었다. 처음 장면에서는 리본이 달린 플랫 슈즈였는데, 클로즈업을 새로 요청할 때마다 어떤 건 굽 있는 힐로 나오고, 어떤 건 리본이 없는 밋밋한 신발로 나왔다. 바닥도 마찬가지였다. 원래 장면엔 러그가 깔려 있었는데, 클로즈업에서는 러그 없이 그냥 나무 바닥만 나오기도 했다.
얼굴 클로즈업도 예외가 아니었다
소품만 그런 게 아니었다. 벨라나 본즈의 표정 클로즈업을 요청했을 때도 비슷한 일이 있었다.
분명 소파에 앉은 채로 얼굴만 클로즈업해달라고 했는데, 결과물에는 캐릭터가 소파에서 일어선 상반신으로 나오거나, 아예 탁자 앞쪽으로 나와 서 있는 모습으로 나와서 당황스러웠다. 앉아 있어야 하는 장면인데 서 있는 걸로 바뀌어버리니, 이건 그냥 클로즈업 문제가 아니라 자세 자체가 완전히 다르게 나온 셈이었다.
왜 이런 일이 생기는지 알아봤다
이건 프롬프트에 "QuietCorner 배경에서", "소파에 앉아서" 같은 장면 설명을 습관적으로 계속 넣었기 때문이라는 걸 나중에 찾아보고 알았다. "얼굴 클로즈업"을 원한다면 standing, sitting, full body 같은 전신·자세 관련 단어는 아예 프롬프트에서 빼야 하고, 대신 눈이나 얼굴 같은 특정 부위를 직접 지정해야 한다고 한다. 아이러니하게도 "앉아 있는 상태를 유지해달라"고 자세를 명시한 게, 오히려 모델이 그 자세를 화면 전체에 다시 그리려는 시도로 이어져서 클로즈업이 깨지는 원인이 됐을 수 있다는 것이다.
결국 원본 이미지를 그대로 크롭하는 쪽으로 방향을 바꿨다
그래서 방법을 아예 바꿨다. Flow에게 새로 그려달라고 하는 대신, 이미 잘 나온 원본 장면(신발, 러그, 소파 다리가 다 정확하게 있는 컷)을 그대로 두고, 그 안에서 신발 부분만 이미지 편집으로 잘라내는 방식으로. 이러면 디테일이 흔들릴 일 자체가 없다. 새로 그리는 게 아니라 이미 있는 걸 오려내는 거니까.
Flow 안에서도 "이 이미지를 그대로 두고 이 부분만 잘라내라"는 식으로 강하게 지시하면 어느 정도는 되긴 하는데, 그래도 완전히 똑같이 크롭만 하는 것보다는 조금씩 다시 그려지는 경향이 있어서, 디테일이 정말 중요한 소품 컷은 아예 후처리로 자르는 쪽이 더 확실했다. 해상도를 높여야 하는 경우에는 크롭된 이미지를 플로우에 올리고 다시 첨부된 이미지를 다시 만들라고 하는 방법으로 해결하기로 했다.
여전히 못 푼 것
Flow 안에서 "새로 생성하지 말고 정확히 이 부분만 잘라내라"는 지시를 아무리 강하게 줘도, 완벽하게 원본 그대로 크롭되는 건 아니었다. 이게 프롬프트 구조의 문제인지, 아니면 이 기능 자체가 애초에 "재생성" 위주로 설계되어 있어서 한계가 있는 건지는 아직 확실히 모르겠다.
디테일이 중요한 컷과 그렇지 않은 컷을 미리 구분해서, 중요한 건 처음부터 후처리 크롭을 염두에 두고 고해상도로 뽑아두는 습관을 들여야 할 것 같은데, 이걸 매번 판단하는 기준은 아직 없다.
전신·자세 관련 단어를 빼고 얼굴 부위를 직접 지정하는 방식은 아직 실제로 적용해보지 못했다. 다음번엔 이 방식으로 다시 시도해서, 소파가 배경으로 튀어나오는 문제가 실제로 줄어드는지 확인해볼 계획이다.
정리
AI 이미지 생성 도구에서 "확대"나 "클로즈업"이라는 말은 사람이 생각하는 것과 다르게 동작할 수 있다는 걸 이번에 제대로 배웠다. 같은 장면의 일부를 보여달라는 요청이, 실제로는 완전히 새로운 이미지를 만들라는 요청으로 처리될 수 있다는 것. 이런 경우엔 도구 안에서 계속 프롬프트를 다듬기보다, 이미 나온 결과물을 다른 방식(편집 툴)으로 활용하는 게 오히려 더 빠른 답일 수 있다는 걸 배운 하루였다.