AI가 자꾸 서양인 모델만 그렸다 — 한국 브랜드 화보를 만들며 겪은 편향과 우회법
티셔츠 브랜드 WILD HUMBLE의 첫 룩북을 AI에게 맡겼을 때의 일이다. 여행 사진을 그래피티 스케치 도안으로 바꾸고, 그 옷을 입은 착용컷까지 AI로 만든다는 계획이었다. 도안은 잘 나왔다. 문제는 사람이었다. 착용컷 다섯 장을 받아 들고 한참을 봤는데, 모델이 전부 금발 서양인이었다. 한국 브랜드의 첫 화보인데.

무엇이 안 통했나
프롬프트를 다시 열어봤더니 모델 묘사는 a tall man이 전부였다. 키 큰 남자. 그 이상 아무것도 없었다. 나는 머릿속으로 당연히 한국인을 그리고 있었지만, 그 당연함은 프롬프트에 한 글자도 적혀 있지 않았다.
비슷한 사고가 두 번 더 있었다. “오버핏 티셔츠"라고 썼더니 허리가 들어간 여성복 라인이 나왔고, 배경을 “리스본 골목"이라고만 썼더니 골목은 충실히 그리고 정작 주인공인 트램을 빼먹었다. 도안 쪽에서도 “vivid blue tiles"라고 했더니 타일이 아니라 성화 벽화가 나왔고, “파편 없음"이라고 써도 파편이 계속 생겼다.
공통점은 하나다. 전부 사람끼리는 통하는 말이었다. 오버핏, 리스본 골목, 선명한 파란 타일. 같은 문화권의 사람에게 말하면 알아듣는다. AI는 그 문맥을 공유하지 않았다.
무엇이 통했나
모델 블록을 이렇게 고쳤다.
a tall KOREAN man (184cm, slim athletic build, broad shoulders,
small head proportion, East Asian skin tone),
face not visible (back view, or framed from chin down to mid-thigh)
KOREAN 한 단어와 East Asian skin tone 한 구절. 그 뒤로 서양인 모델은 다시 나오지 않았다. 지금 쇼핑몰에 걸린 착용컷은 전부 이 블록에서 나온 것이다. 배경도 옷도 구도도 그대로인데 단어 하나로 사람이 바뀐 두 장을 나란히 놓으면 좀 허탈하다.
얼굴을 안 보이게 한 것도 의도였다. 뒷모습이거나 턱 아래부터 허벅지까지만 잡는 프레임. 등판 도안이 주인공인 옷이라 뒷모습이 자연스럽기도 했고, 이유는 두 가지였다. 얼굴을 그리기 시작하면 컷마다 인상이 달라져 일관성이 무너졌고, 동시에 실존 인물로 오해될 초상권 문제도 아예 생기지 않게 하고 싶었다.
나머지 사고도 같은 방식으로 잡혔다.
- 오버핏 →
BOXY, unisex, wide straight silhouette, dropped shoulders, NO darts, NO fitted waist. 특히NO darts가 결정적이었다. 다트는 옷을 몸에 붙이는 봉제선인데, 그걸 금지하자 각진 스트리트 핏이 나왔다. - 리스본 골목 → 배경에 무엇이 반드시 들어가야 하는지 콕 집어 명시.
- 파란 타일 → 4×5 격자, 빠진 자리는 3열 4행, 기울기 15도처럼 좌표로.
- 파편 없음 → “그림 전체 어디에도 파편 없음"으로 범위를 못 박고, 표현을 바꿔 두 번 반복.
이걸 전부 프롬프트규칙.md라는 파일에 고정 텍스트로 박아두고 매번 앞에 붙였다. 아줄레주 도안 하나에 다섯 번 재생성하던 게 한두 번으로 줄었다. 무료 크레딧 100개 중 89개를 쓰고 나서야 만든 문서다.
왜 서양인이 나왔나 — 내 해석
AI가 뭘 잘못한 건 아니라고 본다. “사람"이라고만 하면 학습 데이터의 평균값이 나오고, 그 평균이 서양인이었을 뿐이다. 내가 쓴 생성기가 어떤 데이터로 학습됐는지 나는 모르지만, 영어 프롬프트로 영어권 웹 이미지 생성기를 쓰면서 아무 지정도 안 하면 그쪽 평균이 나오는 게 이상할 건 없다.
그래서 이걸 “AI의 편향"이라고 부르는 게 맞는지 잠깐 고민했다. 편향은 맞다. 기본값이 한쪽으로 쏠려 있으니까. 다만 내 입장에서 더 정확한 표현은 내 머릿속 기본값과 도구의 기본값이 달랐다는 것이다. 나는 “모델"이라는 단어에 한국인을 넣어 읽고, 도구는 다른 걸 넣어 읽었다. 그 차이를 메우는 건 도구가 아니라 지시하는 쪽의 몫이었다.
오버핏 사고가 그 증거다. 인종 문제가 아닌데도 똑같은 구조로 실패했다. “오버핏"이라는 단어에 내가 넣어 읽는 형태(박시한 남녀공용 스트리트 핏)와 도구가 넣어 읽는 형태가 달랐다. 결국 편향이든 아니든 해법은 같았다. 형용사가 아니라 설계도로 쓰고, 당연한 것일수록 적는다.
다음에 화보를 만든다면
한국 브랜드의 착용컷을 AI로 만든다면 처음부터 이렇게 하겠다.
- 모델 블록을 먼저 고정한다. 인종·피부톤·체형·얼굴 노출 여부까지. 매번 새로 쓰지 않는다.
- “당연한 것"을 의심한다. 내가 적지 않았는데 나오길 기대하는 게 있다면 그게 다음 사고다.
- 실패한 컷을 지우지 않는다. 위의 BEFORE 컷은 재생성하면서 덮어쓸 뻔했고, 홍보용으로 따로 남겨둔 한 장만 살았다. 그게 이 글의 교재다.
AI는 창의적 파트너라기보다 정확한 지시서를 정확히 따르는 작업자였다. 서양인 모델은 그 작업자가 내 지시서의 빈칸을 자기 기본값으로 채운 결과였고, 빈칸을 없애자 사고도 없어졌다.
이 글은 제 여행 기록과 작업 로그를 바탕으로 초안을 AI와 함께 정리하고, 직접 편집했습니다.