이미지 생성기에서 가장 어려운 일은 여러 렌더에 걸쳐 같은 사람을 유지하는 것입니다. 얼굴 제어가 없는 좋은 프롬프트는 어떤 사람의 좋은 그림을 만들어 주지만, 다음 렌더는 다른 사람이 됩니다. 캐릭터를 쌓아 가는 작업이라면 — 이야기든, 프로필이든, 브랜드든 — 이건 문제가 됩니다.
Pro 생성기에는 네 단계의 face preservation이 있습니다. 알맞은 단계를 고르고 알맞은 입력을 주면, 같은 얼굴이 세션 내내 모든 렌더에 따라옵니다.
먼저 아바타를 고정하세요
Pro 생성기의 Face preservation 패널에서 face picker를 엽니다. 업로드해 둔 모든 소스 얼굴이 들어 있는 face library와 새로 올릴 슬롯이 보입니다. 가장 먼저 선택한 사진이 고정된 아바타가 됩니다. 다른 어떤 일을 하기 전에 먼저 하나를 고정하세요.

Charmloop의 face flow는 멀티 이미지 단계(IP-Adapter, InstantID, PuLID 변종)에서 최대 네 개의 소스 얼굴까지 받습니다. 슬롯을 활용하세요. 고정 한 장과 서로 다른 각도에서 가져온 보강용 세 장의 조합은, 한 장만 쓰는 것보다 훨씬 강한 정체성을 모델에 전달합니다. 3/4 측면 인물 사진, 거의 정면, 살짝 옆모습 한 컷이면 강한 세트가 됩니다.
용도에 맞는 단계를 고르세요
Face preservation 패널은 네 단계를 노출합니다. 충실도와 토큰 비용을 맞바꾸는 구조입니다.
- None — 모델 자유, 정체성 이월 없음. 가장 저렴합니다. 사람이 중요하지 않은 경우 — 스톡 사진풍 렌더나 환경 컷이 필요할 때 — 에 씁니다.
- ReActor only — 빠른 페이스 스왑입니다. 모델이 자유롭게 얼굴을 만든 뒤, ReActor가 그 위에 내가 지정한 얼굴을 덧씌웁니다. 단일 얼굴 인물 사진에는 좋지만 측면 각도나 특이한 조명에서는 평범합니다.
- IP-Adapter + ReActor — 정체성을 IP-Adapter face embedding으로 생성 자체에 녹여 넣고, ReActor가 마무리합니다. 대부분의 리얼리스틱 캐릭터 작업에서 기본 권장 옵션입니다. 각도, 표정, 조명이 바뀌어도 정체성을 훨씬 잘 유지합니다.
- InstantID + IP-Adapter — 포즈, 조명, 스타일이 크게 바뀌어도 정체성을 안정적으로 유지하는 가장 강한 단계입니다. 같은 사람이 매우 다른 장면(클로즈업 인물 사진, 풀바디 액션, 3/4 측면)에 등장해도 한 사람으로 읽혀야 할 때 권장합니다.
각 단계의 추가 비용은 고정 비율이 아니라 레시피, 해상도, 스텝 수, 배치 크기에 따라 달라집니다. 생성 버튼 옆의 charm 예상치가 실행 전에 현재 설정의 정확한 비용을 보여줍니다.
대원칙은 이렇습니다. 누군가의 좋은 인물 사진이 한 장만 필요하다면 ReActor로 충분합니다. 여러 컷의 스토리나 캐릭터 세트를 쌓는 거라면 IP-Adapter+ReActor나 InstantID에 추가 charm을 들일 가치가 있습니다.
프롬프트로 face flow와 싸우지 마세요
자주 보이는 실수가 있습니다. InstantID를 선택해 두고 좋은 소스 얼굴 세 장을 넣어 둔 상태에서 프롬프트에 "a different woman", "a blonde model", "anime style" 같은 말을 적는 경우입니다. 이때 모델에게는 모순된 두 가지 지시가 동시에 가는 셈입니다. 정체성을 유지하라는 것과 정체성을 바꾸라는 것. 그러면 소스 얼굴도 프롬프트도 닮지 않은 혼란스러운 렌더가 나옵니다.
프롬프트는 장면, 의상, 조명, 분위기를 묘사해야 합니다. 사람을 다시 묘사하면 안 됩니다. 고정된 아바타가 녹색 눈의 갈색 머리라면 "blonde with blue eyes"라고 쓰지 마세요. face flow가 그것과 싸우게 되고, 한쪽은 결국 집니다.
a blonde woman with blue eyes, blue dress, beach, sunset
walking along an empty beach at sunset, light blue cotton sundress, hair tied back, soft golden hour light from camera-left, 50mm portrait, shallow depth of field
강한 버전은 머리 색, 눈 색, 얼굴 형태를 언급하지 않습니다. 그것들은 고정된 아바타에서 옵니다. 프롬프트는 그 사람의 주변만 묘사할 뿐입니다.
클로즈업에는 FaceDetailer를 켜세요
Pro 생성기의 Post-processing 패널에는 Face Detailer 토글이 있습니다. 얼굴이 프레임에서 클 때 — 인물 사진, 반신 컷, 얼굴이 이미지의 1/4 이상을 차지하는 모든 경우 — 켜세요. FaceDetailer는 얼굴 영역을 더 높은 디테일로 다시 렌더링해서, 일반적인 SDXL 얼굴 결함(비대칭 눈, 뭉개진 입, 잃어버린 홍채 디테일)을 잡아 줍니다.
얼굴이 작게 잡히는 와이드 환경 컷에서는 끄세요. 60×60 픽셀짜리 얼굴 영역을 다시 렌더링하는 건 시간만 들고 별 도움이 되지 않습니다.

소스 얼굴 품질이 다른 모든 것보다 먼저입니다
face flow의 모든 단계는 거기에 넣은 소스 얼굴의 품질을 그대로 물려받습니다. 흐릿한 휴대폰 컷, 필터 잔뜩 먹은 셀카, 선글라스에 가린 얼굴 같은 것은 identity embedding을 오염시키고, 모델은 매 렌더마다 모호한 신호를 맞춰 보느라 시간을 씁니다. 알맞은 소스 얼굴을 고르는 데 쓴 2분이 나중에 수십 번의 재시도를 줄여 줍니다.
좋은 소스 얼굴은 다음과 같은 모습입니다.
- 정면 광, 중립 표정. 양쪽 눈에 큼직한 직접 캐치라이트가 들어가 있고, 눈썹 아래나 턱 밑에 깊은 그림자가 없습니다.
- 깔끔한 배경. 패턴이 있거나 어수선한 배경은 embedding으로 새어 들어갑니다. 단색 벽, 중립적인 야외 장면, 스튜디오 그레이가 가장 좋습니다.
- 머리는 보이되 얼굴을 가리지 않음. 머리를 뒤로 묶거나 가운데 가르마 정도가 이상적입니다. 한쪽 눈을 가리는 옆가르마 머리는 비대칭 embedding을 만들어 모든 렌더를 한쪽으로 기울입니다.
- 얼굴이 프레임의 40~70%를 차지함. 큰 이미지 속 너무 작은 얼굴은 정보가 부족하고, 얼굴이 프레임 가장자리에 닿을 만큼 빡빡한 크롭은 특징이 잘려 나갈 수 있습니다.
- 필터 없음, 짙은 메이크업 없음, 극단적인 각도 없음. 특히 뷰티 필터는 face flow가 정체성을 인식할 때 쓰는 텍스처 단서를 망가뜨립니다.
라이브러리에 쓸 만한 사진이 한 장뿐이어도 괜찮습니다. 그것을 고정하고 ReActor 같은 단일 얼굴 flow에 머무르세요. 쓸 만한 세트가 셋에서 넷 정도 있다면 IP-Adapter나 InstantID 단계를 자신 있게 쓸 수 있습니다.
한 프레임에 여러 인물
Charmloop의 멀티 이미지 flow는 최대 네 개의 소스 얼굴을 받지만, 모두 하나의 정체성에 묶입니다. 한 렌더에 서로 다른 두 사람을 넣으려면 — 대화하는 두 캐릭터, 듀엣 인물 사진 — 다른 접근이 필요합니다. 각 인물을 별도 렌더로 만들어 합성하거나, 이미 고정된 첫 인물 위에 img2img 패스로 두 번째 캐릭터를 끌어들이는 방식입니다.
실용적인 패턴은 이렇습니다. 메인 캐릭터를 원하는 포즈로 먼저 렌더링하고, 그 렌더를 저장합니다. 그 다음 그 렌더를 strength 0.6의 img2img source로 두고, 프롬프트에는 두 번째 캐릭터가 프레임 안으로 들어오는 모습을 적습니다. 이 두 번째 패스의 face flow는 다른 고정된 아바타로 바꿉니다. 모델은 첫 캐릭터를 유지하면서(img2img가 기존 픽셀을 보호하므로) 새 캐릭터를 장면에 그려 넣습니다.
이것은 현재 업계 전반에서 face preservation 기술이 거친 부분 중 하나입니다. 깔끔한 "두 정체성" flow는 아직 없습니다. 두 사람 장면은 합성 작업이 필요하다고 미리 계획하세요.
손과 눈은 별개의 문제입니다
face flow는 얼굴을 유지합니다. 손을 고쳐 주지 않고, 렌더 사이의 시선 방향을 안정시키지도 않습니다. 손은 별도의 post-processing 토글(Hand Detailer, Post-processing 패널)에서 다룹니다. 손이 보이고 중요한 경우엔 켜세요.
시선 방향은 프롬프트가 유일한 지렛대입니다. "looking directly at camera", "looking down", "three-quarter glance to the right" 같은 식으로 지시하세요. 지시가 없으면 시선 방향은 매 생성마다 무작위가 되고, 그러면 정체성이 잠겨 있어도 캐릭터의 일관성이 깨집니다.
다음: 같은 얼굴을 매번 다르게 보이게 만드는 구도, 프레이밍, 종횡비 사용법 → Composition.