원본을 잃지 않고 AI 이미지 변환을 제어하는 방법

5단계 AI 이미지 변환 워크플로: 원본을 준비하고, 변환 대역을 선택하고, 이에 맞는 브리프를 작성한 뒤 한 번에 하나의 변수만 바꾸며 반복합니다.

원본을 잃지 않고 AI 이미지 변환을 제어하는 방법

실망스러운 AI 이미지 변환 결과는 대부분 모델의 실패가 아닙니다. 그것은 다이얼의 실패입니다. 이미 마음에 드는 사진을 업로드하고 원하는 리스타일을 설명하면, 도구는 필터를 덮어씌운 듯 거의 똑같은 복사본을 돌려주거나, 구도를 느슨한 제안 정도로 취급한 전혀 다른 그림을 돌려줍니다. 두 결과 모두 같은 결정을 내리지 않았기 때문에 생깁니다. 바로 원본 이미지 중 얼마나 살아남아야 하는가입니다.

이미지-투-이미지 도구는 그 결정을 명시적인 것으로 만듭니다. 노이즈가 아니라 여러분의 그림에서 출발해 프롬프트를 향해 더 짧은 거리를 이동합니다. 그래서 새로 생성하는 것보다 구도, 포즈, 레이아웃을 더 잘 유지합니다. Kling의 리뷰어는 이 구분을 명확하게 정리합니다. 텍스트-투-이미지는 글로 된 설명으로부터 시각물을 만들어 내는 반면, 이미지-투-이미지는 기존 이미지와 지시사항에서 시작하므로 원본이 피사체, 구도, 스타일, 전반적인 방향을 이끌어갑니다 (Kling, 최고의 AI 이미지 생성기). 그 이동 거리가 얼마나 짧은지를 결정하는 제어는 디노이징 강도, 이미지 가중치, 창의성, 강도 등 여러 이름으로 불리며, 이를 의도적으로 설정하는 것이 쓸 수 있는 변환과 다시 해야 하는 변환을 가릅니다. 다음은 원본 준비부터 결과물 검토까지의 5단계 워크플로입니다.

원본에서 결과까지의 거리가 진짜 제어인 이유

이미지-투-이미지 실행에서 모든 것은 하나의 숫자에 종속됩니다. AI Horde의 파라미터 문서는 이를 직접적으로 설명합니다. 디노이징 강도는 시작 이미지가 얼마나 대체되는지를 제어합니다. 0에 가까우면 원본이 대부분 유지되고, 중간 정도에서는 피사체는 살아남은 채 프롬프트가 이미지를 리스타일링할 수 있으며, 1에 가까우면 원본의 실질적인 영향이 거의 또는 전혀 없고, 일반적인 실행은 0.75 부근에 머뭅니다 (AI Horde, 디노이징 강도).

그 범위에는 사용할 수 있는 대역이 있습니다. 건축가에게 자신의 모델을 렌더링하는 방법을 가르치는 한 디자인 스튜디오는 낮은 대역을 0.2–0.35로 제시합니다. 이 대역에서는 도구가 이미지를 거의 건드리지 않고 대신 모든 선을 유지한 채 재질과 빛을 더합니다. 높은 대역은 0.7–0.9로, 느슨한 구도만 살아남고 나머지는 새로 만들어집니다 (Studio Matrx, img2img와 ControlNet). 건축 작업을 위한 권장 중간 설정은 대략 0.35–0.5이며, 이 스튜디오는 잘못된 강도를 AI 렌더가 원래 건물처럼 보이지 않는 가장 흔한 단일 원인으로 꼽습니다.

모든 도구가 그 숫자를 제공하는 것은 아닙니다. 결과물이 참조 이미지와 얼마나 가까운지 제어하는 방법에 관한 OpenArt 자체 FAQ는 Stable Diffusion 프론트엔드가 강도 슬라이더를 제공하고, Midjourney는 이미지 가중치 파라미터를 사용하며, FLUX Kontext와 GPT Image 2 같은 컨텍스트 편집 모델은 슬라이더가 전혀 없다고 지적합니다. 따라서 보존은 대신 프롬프트에 적어 넣어야 합니다. 예를 들어 "같은 얼굴 특징과 헤어스타일을 유지하면서"처럼 말입니다 (OpenArt, 이미지-투-이미지 가이드). 여러분의 다이얼은 숫자일 수도, 슬라이더일 수도, 문장일 수도 있습니다. 그 뒤에 있는 결정은 동일합니다.

1단계 — 원본을 준비하고 반드시 살아남아야 할 것을 나열하기

어떤 변환도 원본에 없는 정보를 복원할 수 없으므로, 가장 저렴한 품질 향상은 도구를 열기 전에 일어납니다. Runway의 튜토리얼은 실용적인 방법을 제시합니다. 기존 사진이나 스케치에서 시작한다면, 아무것도 없는 상태에서 만드는 대신 그것을 업로드하고 원하는 변환을 설명하라고 합니다 (Runway, AI 이미지 만드는 방법). 실제 프레임에서 시작하는 것이 바로 구도에 대한 신뢰할 수 있는 제어를 얻는 방법입니다.

준비는 몇 분간의 정리 작업입니다. 실제로 원하는 프레이밍으로 자르고, 눈에 띄는 노출과 색상 문제를 보정하고, 없애고 싶다고 이미 아는 것은 미리 제거해서 모델이 원본과 다투지 않게 하세요. 나중에 자르는 대신 출력 종횡비를 지금 정하고, 원본의 손대지 않은 사본을 보관하세요. 매 단계마다 그것과 비교하게 되기 때문입니다. 미세한 요소가 살아남아야 한다면 — 제품 라벨, 직물 짜임, 얼굴 — 그것을 보존하는 변환을 요청하기 전에 원본이 그 요소를 담아낼 만큼 선명한지 확인하세요.

그런 다음 프롬프트를 한 글자도 입력하기 전에 세 가지 답을 적어 두세요.

  • 바뀌면 안 되는 것은 무엇인가? 정체성, 기하 구조, 라벨 텍스트, 로고 위치, 조명 방향이 일반적인 불변 요소입니다.
  • 원하는 단 하나의 변경은 무엇인가? 한 번에 하나의 주요 변경만 두면 브리프와 검토가 모두 다루기 쉬워집니다.
  • 출력의 형태는 무엇인가? 해상도, 종횡비, 형식은 계획에 속하며, 마지막의 구제 시도에 속하지 않습니다.

2단계 — 프롬프트를 쓰기 전에 변환 대역 고르기

오늘 얼마나 모험적이고 싶은지가 아니라, 무엇이 살아남아야 하는지를 기준으로 대역을 고르세요. 세 가지 대역이 대부분의 작업을 포괄합니다.

  • 터치업 (대략 0.15–0.35). 기하 구조, 가장자리, 구도가 유지되고, 프롬프트는 재질, 빛, 마감을 제공합니다. 제품 사진의 조명을 바꾸거나, 그레인을 더하거나, 피사체가 이미 잘 어울려 있는 배경을 정돈하는 대역입니다.
  • 리스타일 (대략 0.35–0.6). 피사체와 레이아웃은 유지된 채 표면, 팔레트, 분위기가 다시 만들어집니다. 위에서 언급한 스튜디오가 매스가 그대로 유지된 채 거친 3D 뷰를 완성도 높은 렌더로 바꾸는 데 권장하는 대역입니다.
  • 재창조 (대략 0.7–1.0). 이미지가 아니라 아이디어를 유지하는 것입니다. 구도는 흐트러지고, 작은 디테일은 사라지며, 정말로 보존해야 했던 것은 무엇이든 의도적으로 다시 도입해야 합니다.

두 가지 규칙이 선택을 정직하게 유지합니다. 클라이언트나 검토자가 그 변화를 알아차릴 것 같다면, 그 요소는 보존 그룹에 속하며 여러분을 더 낮은 대역으로 밀어냅니다. 그리고 아래가 아니라 위로 작업하세요. 필요하다고 생각하는 값보다 낮게 시작하고, 결과가 너무 소심하게 나올 때만 값을 올리세요. 소심한 리스타일에서 회복하는 것은 한 번의 추가 패스면 되지만, 파괴된 구도에서 회복하는 것은 대개 처음부터 다시 시작하는 것을 의미합니다.

평범한 회색 스튜디오 표면 위에 일렬로 놓인 다섯 개의 똑같은 석고 큐브. 첫 번째는 매끄럽고 손대지 않은 상태이며, 뒤따르는 각 큐브는 점점 더 각이 지고 질감이 생기고 리스타일된다

3단계 — 대역에 맞는 브리프 작성하기

낮은 대역에서는 불변 요소가 프롬프트의 가장 긴 부분이 되고 변경은 짧습니다. 높은 대역에서는 그 반대로, 목적지 장면을 설명하고 원본은 분위기에 대한 참조일 뿐임을 받아들입니다. 어느 쪽이든 하나의 구조가 브리프를 읽기 쉽게 유지합니다. 목표를 명시하고, 변경을 설명하고, 불변 요소를 다시 밝히고, 그런 다음 새 픽셀이 기존 픽셀과 어떻게 어울려야 하는지에 대한 통합 단서를 추가합니다.

중간 대역의 예: "이 주방 사진을 따뜻한 스칸디나비아식 주광으로 리스타일해 주세요. 표면과 빛만 바꿔 주세요: 연한 오크 수납장, 부드러운 린넨 직물, 왼쪽에서 들어오는 확산된 주광. 방의 기하 구조, 카메라 각도, 창문 위치, 가전 배치는 그대로 유지해 주세요. 그림자의 부드러움과 반사를 원본 촬영에 맞춰 주세요."

OpenArt 자체의 워크스루도 같은 두 가지 의무에 도달합니다. 최종 이미지를 설명하는 프롬프트를 작성하고, 그대로 유지되어야 하는 것을 말하라는 것입니다 (OpenArt). Runway는 순서에 관한 조언을 덧붙입니다. 이미지 모델은 앞쪽 단어에 더 큰 가중치를 두는 경향이 있으므로 가장 중요한 세부사항을 앞에 배치하라고 합니다 (Runway). 긍정적인 설명도 실제로는 부정 목록보다 낫습니다. 표면이 무엇이어야 하는지 모델에 알려주는 것이 추가하면 안 되는 모든 것을 나열하는 것보다 더 신뢰할 수 있습니다.

4단계 — 시드를 고정한 채 한 번에 하나의 변수만 반복하기

대역과 브리프가 일치하면, 모든 것을 다시 쓰는 것을 멈추세요. AI Horde의 지침은 값을 점진적으로 바꾸고 결과를 비교하라는 것이며, 공개된 예시들은 하나의 프롬프트, 하나의 모델, 하나의 시드로 만들어졌고 논의 중인 설정만 움직였습니다 (AI Horde). 그것이 따라야 할 규율입니다. 시드를 고정하고, 라운드마다 하나의 구절이나 하나의 대역 단계만 바꾸고, 나머지 브리프는 동일하게 유지해서 어떤 수정이 효과를 냈는지 알 수 있게 하세요.

수정에 관한 Luma의 지침도 같은 방향을 가리킵니다. 승인된 기반이 그대로 유지되도록 바꿔야 하는 것만 바꾸라는 것입니다 (Luma, AI 이미지 프롬프팅 가이드). 라운드를 거치며 주시할 만한 두 가지 행동이 있습니다. 결과가 불변 요소에서 벗어나면, 새로운 지시를 추가하는 대신 그것을 더 명시적으로 다시 밝히세요. 모델이 원치 않는 요소를 계속 만들어내면, 금지 목록을 늘리는 대신 정말로 원하는 것을 더 정밀하게 설명하세요. 한 라운드가 성공하면 정확한 프롬프트 텍스트와 설정을 저장하세요. 그 줄은 이제 이 피사체를 위한 프리셋입니다.

5단계 — 변경을 제한하고, 전체 크기로 검토하기

변환 값은 전역적입니다. AI Horde는 어떤 객체나 특징이 바뀔지 식별하지 않으며, 영역을 제한하는 도구는 마스크라고 명시합니다 (AI Horde). 구조 제어는 더 나아갑니다. ControlNet은 입력에서 구조 맵 — 가장자리, 깊이 또는 포즈 — 을 추출하고 생성되는 모든 픽셀이 이를 따르도록 강제하며, 프롬프트는 스타일만 제공합니다. 그리고 컨텍스트 편집 모델은 마스킹 없이 지정한 영역만 바꿉니다 (Studio Matrx). 작업이 정말로 좁은 범위라면 전용 도구가 범용 도구보다 빠릅니다. 한 영역을 복구하거나 확장할 때는 생성형 채우기, 방해 요소를 제거할 때는 객체 제거기, 색상만 바뀌어야 할 때는 부분 색상 변경, 프레이밍 자체가 바뀌어야 할 때는 이미지 확장기를 사용하세요. 객체 가장자리 주위에 약간의 여백을 남겨 도구가 새 픽셀을 기존 픽셀에 블렌딩할 공간을 확보하세요.

평범한 표면 위에 선명하고 색이 완전히 살아 있는 채로 놓인 단순한 도자기 그릇 하나, 주변 배경은 부드럽고 차분하게 유지된다

그런 다음 손대지 않은 원본과 나란히, 전체 크기로 제대로 검토하며 다음 네 가지 질문을 순서대로 던지세요. 요청한 변경이 실제로 일어났는가, 불변 요소가 유지되었는가, 새 콘텐츠가 원본의 빛과 원근에 맞게 제대로 자리 잡았는가, 그 밖에 다른 것이 움직였는가. 썸네일은 정작 중요한 결함을 정확히 숨깁니다. 색조가 밀린 것, 가장자리가 부드러워진 것, 로고가 슬며시 움직인 것 같은 결함입니다. 도구가 새로 만들어내야 했던 부분은 확대해서 보세요.

게시하기 전에 알아 둘 만한 한계

세 가지 한계가 워크플로를 정직하게 유지합니다. 모델은 서로 교체할 수 없습니다. 순위는 작업마다 달라지고 같은 문구라도 다른 생성기에서는 다르게 작동하므로, 한 도구에서 통하는 프롬프트가 다음 도구에서도 보장되지 않습니다 (OpenArt). 반복 편집은 손상을 누적시킵니다. FLUX Kontext를 만든 Black Forest Labs는 같은 이미지에 여섯 번 연속 편집한 뒤 눈에 띄는 품질 저하가 나타난다고 문서화했으며, 이는 짧은 체인과 깨끗한 원본을 지지하는 좋은 근거입니다 (OpenArt). 그리고 권리는 픽셀과 함께 이전되지 않습니다. 사용할 권리가 없는 이미지를 변환하지 말고, 허용되지 않은 방식으로 식별 가능한 인물이나 보호받는 캐릭터를 프롬프트로 요청하지 말고, 여러분의 청중이나 플랫폼이 기대하는 곳에서는 AI 편집 사실을 공개하세요.

오늘 이 워크플로를 한 번 실행해 보세요

생성된 것처럼 보이는 변환과 의도된 것처럼 보이는 변환의 차이는 좀처럼 마법의 단어에서 비롯되지 않습니다. 가능한 한 가장 깨끗한 원본을 준비하고, 무엇이 살아남아야 하는지 미리 정하고, 그것을 보호하는 대역을 고르고, 대역에 맞는 브리프를 작성한 다음, 시드를 고정한 채 한 번에 하나의 변수만 움직이고 마지막에는 전체 크기로 검토하세요. 그 루프를 돌리면 강도 값은 더 이상 복권이 아닙니다.

KOOX AI 이미지 투 이미지 도구를 열고, 가장 좋은 원본 프레임을 불러온 다음, 필요하다고 생각하는 것보다 한 대역 낮게 시작하세요. 원하는 변경이 프레임 전체의 리스타일이라면 그 도구가 맞습니다. 하나의 영역이나 하나의 속성이라면 더 좁은 범위의 효과에 작업을 맡기고 나머지 이미지는 그대로 두세요.

게시물 정보

게시일
원본을 잃지 않고 AI 이미지 변환을 제어하는 방법