만화 제작 워크플로우 전반 (2026년 9월 기준)
요약
AI를 활용한 만화 제작 워크플로우 전반을 분석하며, 단순히 이미지 생성 AI(공정 5)만 중요한 것이 아니라 기획부터 조판까지의 체계적인 과정이 핵심임을 강조합니다. 특히 모든 공정 결과를 JSON 정본에 기록하고 다음 에이전트가 이를 읽어 작업하는 방식이 중요합니다.
핵심 포인트
- AI 만화 제작은 다단계 워크플로우로 접근해야 합니다.
- JSON 기반의 정본(Source of Truth) 관리가 필수적입니다.
- 이미지 생성 AI는 일관성 유지를 위해 외부 3D 모델링과 결합되어야 합니다.
- 기획, 플롯, 각본 검정 등 언어적 단계가 그림 그리기보다 중요합니다.
사람이 그리고 있습니다.
이 기사의 가장 마지막에 적혀있습니다.
AI의 힘으로 만화를 그리기가 쉬워졌지만, 원하는 결과를 얻기 위해서는 다양한 노력이 필요합니다. 아마도 이는 앞으로 AI가 진화해도 크게 변하지 않을 것입니다. 인간의 뇌 속 정보를 전달하는 방법은 AI의 진화와 무관하기 때문입니다.
약 3일 동안 약 3,300자 분량의 오리지널 단편 소설 『동면』을 6페이지 26컷의 만화로 만들었습니다.
네임(Name), 초안, 완성본입니다. 이 기사에서는 그 작업 과정을 되돌아봅니다.
제작은 Claude Code(리더)와 Codex(작화 담당 워커)를 병렬로 구동했습니다. 멀티 에이전트 환경에 대한 내용은 이전 기사에 있습니다.
줄거리:
법률 사무소에 상담하러 온 여성이 '남편이 사망했다'고 이야기하는 단편입니다. 그런데 남편이 살아납니다. 사망과 구분할 수 없는 '동면'을 반복하고 있는데, 그 기간이 4시간, 다음 날 아침, 3일, 2주로 늘어납니다. 마지막에 여성은 '의사에게 보여드리면 남편은 화장됩니다. 그것은 제가 남편을 죽이는 것이 되는 건가요?'라고 묻고, 변호사는 대답하지 않은 채 끝납니다.
거의 대화극이며, 장소는 응접실과 회상하는 침실 두 곳뿐입니다. 만화화 소재로는 상당히 쉬운 편에 속할 것입니다.
제작에는 MyManga라는 자체 스킬을 사용했습니다. 그곳에서의 공정 정의는 다음과 같습니다.
| 공정 | 내용 | 주요 결과물 |
|---|---|---|
| 0 | 기획・독자 계약 | project.json , NAME.md |
| 0.5 | 인물의 행동 원리 | project.json의 behavior_principle |
| 1 / 1.5 | 인물・공간 플롯・각본 | plot.json |
| 1.8 | 각본 검정 | |
| 2 (N1〜N6) | 네임 | pages/pNNN.json |
| ... | 5 | 작화(이미지 생성) |
| 5.5 | 공간의 위화감 검사 | qa/ |
| 마무리 | 네임 에디터 | pages/pNNN.json |
| 6 | 조판・식자 삽입 | out/*.pdf |
| 7 | 심사・납품 |
소위 '프롬프트로 그림을 뽑아내는' 것은 공정 5뿐입니다. 그 이전은 언어와 공간을 결정하는 공정이고, 이후는 배열했을 때의 파탄을 찾아 고치는 공정입니다.
중요한 것은 각 공정의 결과를 JSON의 정본에 기록하고, 다음 공정은 그것만 읽는다는 것입니다. 대화 내용은 계승되지 않습니다. 에이전트를 교체해도 정본만 있으면 계속 작업할 수 있습니다.
'몇 페이지 끝까지 독자에게 무엇이 전달되어야 하는가'를 정의합니다. NAME.md에는 다음과 같이 기술됩니다.
| 시점 | 독자가 여기까지 알게 된 것 |
|---|---|
| 1페이지 말 | 여성의 남편이 '사망했다'고 이야기됨 |
| ... |
아울러 '여성이 거짓말을 하고 있다/사기 목적'으로 읽히는 것은 곤란하다는 허용하지 않는 독해도 적어둡니다.
재귀적 자기 개선(RSI)을 시키려면 평가 기준을 마련해야 합니다. 초기에 이것을 체크하게 하여, 의미가 전달되고 있는지 여러 다른 에이전트에게 판정하게 합니다.
다음으로, 응접실과 침실의 평면도, 가구, 창문, 인물의 좌표를 plot.json에 적습니다. 단위는 미터이며, 원점은 방의 남서쪽 바닥입니다.
{
"id": "sofa_west",
"position": [2.4, 3.0, 0],
...
}
그리고 Blender로 모델링합니다. 이것이 무대가 되는 법률 사무소입니다.
3D로 환경을 만드는 것은 거의 필수적입니다. 이미지 생성 AI는 같은 방을 기억하지 못하기 때문입니다. 컷마다 생성하면 창문의 위치도 소파의 형태도 일관성을 유지할 수 없습니다. 건축물의 정답은 AI 외부에 가지고 있어야 합니다.
네임은 정보와 인과(N1)부터 초견 시험(N6)까지 6단계로 나누었습니다. 각 컷의 지정은 pages/pNNN.json에 있으며, 예를 들어 4페이지의 회상 컷은 다음과 같습니다 (발췌).
{
"art": {
"prompt": "회상③. 사흘 동안 구급차를 부르지 않고 침대 옆 의자에서 지켜본 클라이언트. 사흘 후, 남편이 눈을 뜨다. 남편은 눈을 뜨고 있다. 클라이언트는 양손을 입에 대고 눈을 크게 뜨며 놀란다.",
...
}
그림 전에 대사, 말풍선 형태, 화자, 인물 좌표와 방향, 카메라, 회상 여부까지 결정됩니다. 이것을 조판하면 그림 대신 구도의 지시문이 들어간 네임이 됩니다.
왼쪽이 네임 초판, 오른쪽이 완성된 2페이지입니다. 칸 나누기와 말풍선 위치는 이 단계에서 거의 결정되며, 체커가 읽는 순서나 말풍선의 겹침을 기계적으로 검사합니다.
먼저 등장인물 참조 시트를 만들고, 각 칸 이미지를 생성할 때 참조 이미지로 전달합니다.
왼쪽부터 변호사, 여성(상담 시), 여성(회상・자택), 남편 순입니다. 여성의 두 번째 패턴은 사람이(나) 체크했을 때 회상 장면에서도 의상이 같다는 위화감을 느껴 추가했습니다. 이런 '이상함'을 알아차리지 못하는 것은 현재 AI의 한계라고 할 수 있습니다.
만화의 어려운 점 중 하나는 같은 공간을 여러 번 그려야 하기 때문에, 한 장씩 보면 정확해도 일관성이 쉽게 무너진다는 것입니다. 그렇지 않도록 고안이 필요합니다.
이것은 침실 장면의 것으로, 각 칸의 3D 가이드와 완성된 그림을 쌍으로 나란히 배치했습니다. 이렇게 3D로 인물의 배치나 방에서의 위치를 정해두지 않으면, 칸 사이에서 모순이 발생하게 됩니다. 건물의 3D 모델과 마찬가지로, 인물을 3D화하는 것도 필수적인 과정입니다.
3D 가이드에서는 Blender의 방에 3D 모델 인형을 놓고, 카메라가 본 머리 위치와 시선의 방향을 이미지로 만들어 칸마다 생성하여 가이드로 이미지 생성에 전달합니다.
왼쪽이 가이드 없이 생성한 것, 중앙이 3D 가이드, 오른쪽이 다시 그린 것입니다. 시선 지시도 전달되고 있음을 알 수 있습니다. 왼쪽은 인물의 위치가 이상하거나, 가구도 방의 설계와 맞지 않습니다.
이미지를 생성한 후에는 머리 중심이 기대 위치에서 얼마나 벗어났는지, 화면의 어느 쪽에 있는지, 어디를 보고 있는지, 창문이 보이는지 등을 대조하며 검사합니다.
|
판정 | 칸 | 수정 요소 | 기대값 | 관찰값 |
|---|---|---|---|---|
| FAIL | p001-1 | lawyer.head_center (distance <= 0.12) | [0.690,0.275] | {"center":[0.627,0.16],"distance":0.1311} |
...
FAIL이 나온 칸은 한 칸당 하나의 티켓으로 다시 그리기에 회신합니다.
그림체는 도중에 두 번 바꿨습니다.
왼쪽부터 초판의 사실주의에 가까운 것, 청년지 스타일, 소박한 손그림 선 순으로 다시 그린 것입니다. 세 장 모두 인물의 위치, 시선, 의상, 가구 배치는 동일하게 유지되었습니다.
원래 그림을 전달하여 그리게 하므로 구도가 바뀔 걱정은 거의 없습니다. 반대로 말하면, 처음에 그리게 하는 그림체는 무엇이든 상관없습니다. 나중에 변경할 것을 고려해서, 너무 무너지지 않도록 그려진 그림이 좋습니다. (그려져 있는 편이 밑그림에 적합하다는 것은 정말 시대가 변한 일입니다)
여기부터는 직접 만든 네임 에디터 MangaNameEditor에 대한 이야기입니다.
Rust + GPUI로 만들어진 로컬 앱으로, MyManga의 원본인 pages/pNNN.json을 직접 열고 편집하고 저장합니다.
여러 시도와 시행착오 끝에, 말풍선 위치・치수・줄 바꿈・입 모양 방향은 AI에게 그림을 다시 그리게 하는 것이 아니라 사람이 에디터로 고치는 워크플로우를 채택했습니다. 얼굴에 말풍선이 덮여 있거나, 읽는 순서가 이상하다 같은 문제를 AI에게 리테이크(retake)를 시키면 끝이 없습니다. AI에게는 상세한 지시가 필요하고, 말풍선의 좌표 수준이 되면 이미지가 인간이 하는 것이 더 효율적이라는 판단입니다.
칸 나누기: 그림과 대사를 35%로 희미하게 하고, 틀과 오른쪽 위 읽기 순서 번호만 보이게 함 -
말풍선: 대사・형태・화자・급수・서체를 편집함 -
입 모양: 입 모양의 끝(화자의 얼굴을 가리키는 타겟)을 드래그로 움직임
말풍선에 '화자'를 명확하게 정의한 것이 핵심입니다. 이 덕분에 말풍선 본체를 드래그해도, 입 모양의 끝은 화자에게 고정된 상태를 유지합니다.
만(ルビ)도 필요하죠. 같은 화자의 두 개의 말풍선이 결합되어 있는 것에도 주목하세요.

에디터로 수정한 내용은 그때마다 원본에 동기화하여 커밋하고 있습니다. git log에서 주요 내용을 가져오면 다음과 같습니다.
| 회 | 일시 | 내용 |
|---|---|---|
| 1~2 | 9/13 | 말풍선 위치 편집, 화자 ID와 순서를 원본에 복원 |
| ... |
말풍선의 위치와 입 모양은 여러 번 고쳤고, 8회 만에 33건이 있습니다. 대사 자체도 추가했는데, 변호사의
남편이 눈을 뜬 장면에서, 여성의 얼굴에 '놀라움'을
- 3일 후에 눈을 뜬 남편, 양손으로 입을 가리는 여성
- 회상 속 여성을 외출복에서 집옷으로 (6컷)
- 변호사의 시선이 상대방에게 향하지 않은 2컷
- 그림체 변경 2회
AI는 이 모든 것을 스스로 알아차리지 못했습니다.
뭐, 아마추어 만화라 지적할 부분이 많겠지만요.
지금까지 할 수 없었던 것이 가능해진 시대. 그 새로운 규칙으로 무엇을 할 수 있을지 생각하는 것은 흥미롭습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Qiita AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기