이번 회차는 게스트로 캐릭터 일러스트를 그려온 아신카르텔 님을 모셨어요. 저는 이미지 쪽 전문가가 아니라서, 그림을 직접 그려온 분이 GPT 이미지 생성을 어떻게 다루는지 옆에서 묻고 듣는 방송이었어요. 아신카르텔 님은 원하는 그림체를 지키려고 자기만의 검사 규칙 묶음(Z팩)을 만들어 쓰고 계세요.
첫 번째로 짚은 건 수정의 함정이에요. 이미지 생성은 노이즈에서 형태를 잡아가는 방식이라, 만든 그림을 "여기만 고쳐줘"라고 계속 수정하면 물티슈로 문지른 것처럼 점점 뭉개져요. 고칠 게 있으면 무엇을 어떻게 바꿀지 정확히 지정해서 새로 뽑는 게 나아요. 자동 검사도 같은 원칙이에요. 기준을 통과하지 못한 그림은 고치지 말고 버리고 다시 그리게 해요.
두 번째는 데이터를 많이 주면 망가진다는 거예요. 캐릭터 시트, 옷 시트, 소품 시트를 한꺼번에 넣으면 부위가 뒤섞인 괴상한 결과가 나와요. 고정할 재료는 두 개 정도로 줄이고, 나머지는 날씨나 빛, 카메라 위치처럼 짧은 프롬프트로 주는 게 잘 나와요. 인물을 여러 레이어로 나눠 그리게 하는 실험도 했는데, 위치를 정확히 맞추지 못해서 실패했어요.
세 번째는 말 대신 그림으로 전달하는 거예요. 그림체는 이름이 정해진 게 아니라서 "이런 스타일로"라고 말해도 GPT가 못 알아들어요. 옷 주름 하나도 말로 고치면 안 되고, 원하는 느낌의 샘플을 보여줘야 해요. 자기가 좋아하는 그림을 모아 스타일별로 나눈 기준 카드를 만들어두면 좋아요. 그림을 틀 안에 억지로 다 넣으라고 하지 말고, 좀 잘려도 된다고 풀어주면 배경이 훨씬 풍부해진다는 발견도 있었어요.
프롬프트 재료로는 색 다섯 개 정도, 핵심 오브젝트 세 개, 인물이 하는 구체적인 동작 세 가지를 넣으라고 알려주셨어요. 구도(L자, 삼각형, 올려다보는 시점)와 조명은 많이 봐야 감이 생기고, GPT도 기본 구도는 스스로 잘 잡아요. 감성이 중요한 그림이라면 Midjourney가 더 낫다는 솔직한 평가도 있었어요. 혼자 해볼 때는 좋아하는 그림 열 장을 모으는 것부터 시작하세요.