
AI 캐릭터 아트에서의 버전 매트릭스 문제
요약
Midjourney와 PixAI를 활용한 AI 캐릭터 생성 과정에서 발생하는 버전 및 모델 간 호환성 문제를 분석합니다. 특정 모델 버전과 참조 이미지 사용 시 발생하는 의존성 문제와 캐릭터 일관성 유지의 어려움을 다룹니다.
핵심 포인트
- 모델 버전과 기능 간의 복잡한 호환성 매트릭스 문제 발생
- 참조 이미지 로드 시 모델 버전이 자동으로 변경되는 현상
- 애니메이션 모델(niji)의 특정 파라미터 지원 미비
- 캐릭터 정체성 유지를 위한 참조 상태 유지의 어려움
의존성(dependencies)을 관리해 본 사람이라면, 이미지 생성기를 다루지 않더라도 이 문제의 형태를 바로 알아챌 것입니다.
저는 오후 내내 동일한 오리지널 캐릭터를 Midjourney와 PixAI에 통과시켜 보았는데, 흥미로운 결과가 나왔습니다. 이는 이미지 품질과는 전혀 상관없는 문제였습니다. 바로 호환성 매트릭스(compatibility matrix) 문제였습니다.
테스트 대상
평범한 언어로 한 번 기술된 하나의 캐릭터: 30대 중반의 성인 여성, 얇게 땋은 머리가 있는 짧은 애쉬 그레이 헤어, 왼쪽 눈썹을 가로지르는 흉터, 스틸 블루 색상의 눈, 체인이 달린 황동 단안경(monocle), 높은 칼라가 달린 두꺼운 네이비 코트, 오른쪽 팔뚝의 가죽 랩, 그리고 왼쪽 어깨 위의 작은 황동 태엽 팔콘(clockwork falcon).
확인 가능한 8가지 속성. 두 플랫폼 모두 동일한 설명을 사용했으며, 특정 결과만을 골라내는 체리 피킹(cherry-picking)은 하지 않았습니다.
매트릭스
2026년 8월 초 기준 Midjourney의 버전 드롭다운은 1부터 8.2까지 실행되며, 7월 24일 이후로는 8.2가 기본값입니다. 구분선 아래에는 애니메이션 모델인 niji 7, niji 6, niji 5, niji 4가 위치합니다. 캐릭터 작업에 중요한 호환성은 다음과 같습니다:
기능 사용 가능 버전
-------------------------- --------------------------------
현재 기본 모델 8.2
...
이를 의존성 그래프(dependency graph)로 읽는다면, 무언가를 생성하기도 전에 문제가 눈에 보입니다. 최신 모델, 애니메이션 모델, 그리고 캐릭터 고정(character lock) 기능이 서로 세 가지 다른 버전으로 해결됩니다.
런타임(runtime)이 실제로 수행하는 것
테스트 과정에서 매트릭스만으로는 알 수 없는 세 가지 동작이 나타났습니다.
참조(reference)를 로드하면 모델이 조용히 변경됩니다. Midjourney의 문서에 따르면 참조 이미지를 추가하면 프롬프트가 버전 7(version 7)에서 실행됩니다. 제가 실행한 참조 작업들은 몇 분 전 기본 모델이 생성했던 회화적인 결과물 대신, 해당 모델의 렌더링 스타일로 결과가 나왔습니다. 이 과정 중 어디에서도 이러한 트레이드오프(tradeoff)가 수용 가능한지 묻는 단계는 없습니다.
애니메이션 모델들은 해당 파라미터(parameter)를 완전히 거부합니다. niji에서 참조를 로드하는 것은 작동하지만, 이후 niji가 참조 강도를 조절하는 가중치 설정인 OW를 지원하지 않는다는 문구가 나타납니다. 대신 스타일 참조(Style reference)가 제안되는데, 스타일 참조는 정체성(identity)보다는 외형(look)을 전이시킵니다.
참조 상태는 유지되지 않습니다. 매 실행마다 참조를 다시 첨부해야 합니다. 장면을 바꾸고 생성했더니 다른 여성이 나타났습니다: 애쉬 그레이(ash grey) 대신 갈색의 웨이브 머리, 다른 얼굴, 다른 연령대였습니다. 경고도, 오류도 전혀 없었습니다. 그저 제가 여전히 결합되어 있다고 가정했던 입력값 없이 배치(batch)가 생성되었을 뿐입니다.
올바르게 설정되었을 때, 버전 7은 두 번의 장면 변화 속에서도 캐릭터를 잘 처리했습니다. 머리카락, 체격, 그리고 코트가 유지되었습니다. 황동 매(brass falcon)는 매번 평범한 새의 모습으로 나타났고, 옷의 색상은 실행할 때마다 조금씩 달라졌습니다.
다른 경로
PixAI는 이를 매트릭스(matrix)가 아닌 하나의 런타임(runtime)으로 접근합니다. 애니메이션 모델을 선택하면(제 경우에는 Tsubaki.2), 참조 도구, LoRA 레이어, 그리고 편집 도구가 동일한 생성 패널에 위치합니다. LoRA는 베이스 모델(base model)에 대해 학습된 작은 추가 파일로, 모델에게 스타일, 캐릭터, 또는 세부적인 처리 방식을 가르칩니다. 이 플랫폼은 커뮤니티 LoRA와 직접 학습시키는 것을 모두 지원합니다.
제가 예상하지 못했던 결과는 다음과 같습니다. 참조 이미지(reference image)를 로드하지 않은 상태에서 동일한 텍스트 설명(written description)을 세 가지 장면(scene)에 실행했더니 매번 동일한 인물이 생성되었습니다. 정오의 시장, 밤의 작업실, 부두 위의 비. 의상과 표정은 달랐지만, 매의 황동 부속품(brass fittings)을 포함한 식별 가능한 세부 사항들은 그대로 유지되었습니다.
완벽하지는 않습니다. 어떤 이미지에서는 흉터가 뺨으로 이동하기도 하고 코트의 세부 사항이 변하기도 합니다. 하지만 이 방식이 제거하는 것은 상태 관리(state management)입니다. 다시 연결해야 할 것도, 전환해야 할 버전(version)도 없으며, 한 브랜치(branch)에는 존재하지만 다른 브랜치에는 존재하지 않는 특징도 없습니다.
각각의 방식이 적절한 경우
Midjourney는 여전히 훌륭하며, 단일 이미지 생성이나 스타일 탐색(style exploration)의 경우에는 버전 매트릭스(version matrix) 문제가 발생하지 않습니다. 하나의 모델을 유지하며 생성하기 때문입니다. Midjourney의 미적 도구(aesthetic tooling)는 대부분의 도구보다 깊이가 있으며, 첫 이미지를 생성하기 전에 월 10달러부터 시작하는 유료 구독이 필요합니다.
매트릭스로 인한 비용이 발생하기 시작하는 시점은, 하나의 캐릭터가 6개월 동안 20장의 이미지를 통해 유지되어야 할 때입니다. 그 시점이 되면 질문은 '어떤 모델이 더 잘 렌더링(render)하는가'가 아니라, '20번째 이미지에 도달하기까지 얼마나 많은 설정(setup) 과정이 남아 있는가'로 바뀝니다.
만약 당신이 그런 작업을 하고 있다면, PixAI에서 하나의 설명이 어디까지 도달할 수 있는지 확인해 보세요. 빠른 시작 가이드(quick start guide)에서 인터페이스의 기본 사항을 다룹니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기

