두 명의 AI 작업자가 카드 한 장을 만들었습니다. 그 인수인계 과정이 시험대였습니다.
요약
여러 AI 에이전트가 협업하여 트레이딩 카드를 제작하는 실험을 통해, 에이전트 간의 작업 인수인계와 피드백 루프의 중요성을 분석합니다. 단순한 결과물 생성을 넘어, 오류를 식별하고 작업을 거부하거나 수정 요청을 보내는 멀티 에이전트 워크플로우의 실질적인 작동 방식을 보여줍니다.
핵심 포인트
- 에이전트 간의 성공적인 인수인계는 단순 전달이 아닌 명확한 피드백과 거절을 통해 이루어짐
- 멀티 에이전트 시스템에서 각 작업자의 역할 분리와 작업 수락/거절 메커니즘의 중요성
- 인간의 승인과 개입이 유지되는 상태에서 AI 에이전트 팀의 상업적 업무 완수 가능성 확인
두 명의 AI 작업자가 아이디어 단계부터 프린터가 사용할 수 있는 파일 단계까지 트레이딩 카드 한 장을 완성했습니다. 유용한 결과는 작업이 빠르게 진행되었다는 점이 아니었습니다. 두 번째 작업자가 첫 번째 작업자의 결과물을 거부하고, 왜 크롭 (crop)으로 이를 수정할 수 없는지 설명하며, 인간의 메시지 전달 없이 결과물을 다시 돌려보냈다는 점이었습니다.
이 과정은 공개 Slack 채널에서 운영되는 소규모 개인 소유 트레이딩 카드 비즈니스인 New Street Studios 내부에서 발생했습니다. LUDO-01은 게임과 카드를 디자인합니다. INKA-01은 인쇄 제작 (print production)을 담당합니다. VENDA-01은 상점을 관리합니다. CORA-01은 채널을 호스팅합니다. 저는 각 세션을 열고 채널을 벗어나는 결과물을 승인합니다.
이 실험은 의도적으로 좁은 범위를 다룹니다. 작업의 경계, 인수인계 (handoff), 오류, 그리고 인간의 승인이 가시적으로 유지될 때, 별개의 AI 작업자들이 일반적인 상업적 업무를 완수할 수 있는지를 묻는 것입니다. 'Cassel Oryn'이라는 카드 한 장이 지금까지 가장 명확한 답을 제시했습니다.
인수인계가 성공적이었던 이유는 두 번째 작업자가 첫 번째 작업자의 결과물을 거부했기 때문입니다.
카드 한 장, 5단계, 숨겨진 전달 과정 없음
LUDO-01은 첫 번째 Cassel Oryn 일러스트레이션을 전달하고 구도가 디자인 검토를 통과했다고 보고했습니다. INKA-01은 채널에서 동일한 결과물을 읽고 제작 실행을 중단했습니다. 장면 중앙에 있는 조약 문서는 캐릭터에 의해 가려져 있었습니다. 줌 (Zooming)을 하거나 크롭 (crop)을 이동하더라도 이미지에 존재하지 않는 정보를 드러낼 수는 없었습니다.
이러한 차이는 중요합니다. 미흡한 검토는 "이것은 올바르게 보이지 않습니다"라고 말합니다. 유용한 제작 검토는 실패 지점을 명시하고, 왜 사용 가능한 도구로 이를 수정할 수 없는지 설명하며, 수정을 담당하는 작업으로 업무를 라우팅 (routing)합니다.
인수인계는 다음과 같았습니다:
| 단계 | 담당자 | 작업 수락 여부 | 중단 사유 |
|---|---|---|---|
| 캐릭터 아트 생성 | LUDO-01 | 카드 브리프 및 세계관 규칙 | 디자인 방향성 부재 |
| ... |
INKA-01은 일러스트레이션을 다시 디자인하지 않았습니다. 대신 아트 문제를 LUDO-01에게 다시 보냈습니다. LUDO-01은 이를 재생성했습니다. 그 후 저는 규칙 외의 텍스트(non-rule copy)를 4분의 1로 줄여달라고 요청했습니다. INKA-01은 이 요청을 두 가지 결정으로 분리했습니다: 카드 전용 아트 수정과 이후의 카드들에 영향을 미칠 템플릿 변경입니다. 템플릿 결정은 저의 승인을 기다렸습니다.
다음 파일 역시 아직 최종본이 아니었습니다. 저는 캐릭터의 머리 부분에 더 많은 공간이 필요했기 때문에 첫 번째 크롭(crop)을 거절했습니다. INKA-01은 이를 두 단계에 걸쳐 조정하여 인쇄 준비가 된(print-ready) 파일을 생성하고 작업을 중단했습니다. 새로운 지시가 없이는 카탈로그 작업이나 다음 카드로 넘어가지 않았습니다.
이것은 멀티 워커 팀 (multi-worker team)의 실질적인 버전입니다. 즉, 여러 채팅창이 동일한 요청에 답하는 것이 아니라, 별개의 작업들이 서로의 작업을 수락하고 거절하는 방식입니다. Anthropic은 멀티 에이전트 연구 시스템 구축 (building a multi-agent research system)에 관한 설명에서 이와 유사한 오케스트레이터 및 워커 (orchestrator-and-worker) 패턴을 기술하고 있습니다. New Street Studios는 다른 형태의 조정 방식을 사용합니다. 아티팩트(artifact)와 채널(channel)이 작업을 진행시키며, 저는 최종 게이트(final gate)로 남습니다.
거절이 파일보다 더 중요했던 이유
완성된 파일은 출력물(output)입니다. 하지만 다른 작업이 수락, 검사 및 사용할 수 있는 파일은 결과물 (outcome)입니다. 그 차이는 다운스트림(downstream)의 증거에 있습니다.
INKA-01에게는 데모를 더 좋아 보이게 만들 수 있는 세 가지 유혹적인 방법이 있었습니다:
- 첫 번째 일러스트레이션을 수락하고, 다듬어진 목업(mockup) 안에 구도 문제를 숨기는 것.
- 인쇄 제작(print production)이 아트 디렉션을 담당하지 않음에도 불구하고 일러스트레이션을 변경하는 것.
- 제가 크롭을 승인하기 전에 카드를 완료된 것으로 보고하는 것.
그것은 이 중 어느 것도 하지 않았습니다. 더 느린 경로가 더 유용한 기록을 만들어냈습니다: 누가 문제를 발견했는지, 왜 현재의 결과물(artifact)이 통과할 수 없었는지, 어떤 작업(job)이 수정을 담당했는지, 그리고 어떤 결정이 여전히 나에게 속해 있었는지에 대한 기록 말입니다.
운영 규칙 (Operating rule): 인수인계(handoff)는 메시지가 전송되었다고 해서 완료되는 것이 아닙니다. 수신 측 작업(job)이 결과물(artifact)을 사용할 수 있거나, 왜 사용할 수 없는지를 정확하게 설명할 수 있을 때 완료됩니다.
이는 왜 Slack이 단순한 알림 채널이 아니라 작업 표면(work surface)인지에 대해서도 설명해 줍니다. 결과물(artifact), 거절(rejection), 수정(correction), 그리고 승인(approval)이 팀이 읽는 것과 동일한 장소에 놓입니다. 관리자는 개인적인 채팅이나 나중에 작성된 요약본으로부터 작업을 재구성할 필요 없이 작업을 감사(audit)할 수 있습니다.
나는 더 적은 일을 했지만, 중대한 결정권은 유지했다
이 워크플로(workflow)는 인간의 생산 작업을 대체했습니다. 초기 일러스트레이션, 인쇄 전 검토(prepress review), 텍스트 배치(text fitting), 크롭(crop) 조정, 그리고 인쇄 파일 준비는 오늘날 사람들이 수행하는 작업들입니다. 만약 이 접근 방식이 전체 카탈로그에 적용된다면, 이러한 작업들에 필요한 인간의 시간은 줄어들 것입니다. 이러한 대체(displacement)는 솔직하게 언급되어야 합니다.
하지만 인간의 소유권(ownership)을 제거하지는 않았습니다. 나는 비즈니스를 변화시키거나 지속적인 규칙을 설정하는 결정을 내렸습니다:
- 나는 작업 세션(work session)을 열었습니다.
- 나는 뉴욕을 부정확하게 표현한 초기 아트 디렉션(art direction)을 거절했습니다.
- 나는 템플릿 전체에 적용되는 텍스트 축소를 승인했습니다.
- 나는 최종이라고 여겨졌던 첫 번째 크롭(crop)을 거절했습니다.
- 나는 다음 단계로 진행할 수 있는 파일을 승인했습니다.
작업자들은 이러한 결정들 사이에서 반복 가능한 숙련 기술(repeatable craft)을 처리했습니다. 나는 취향(taste), 책임(accountability), 그리고 출시 권한(permission to release)을 유지했습니다. 이러한 분업은 자율성(autonomy)을 주장하는 것보다 덜 극적이지만, 운영하기에는 훨씬 쉽습니다.
이러한 구분은 업무를 너무 광범위하게 할당하는 것에 대한 점검 장치이기도 합니다. 일부 작업은 AI 채용(AI hire)에게 맡겨서는 안 됩니다, 특히 입력값이 모호하거나, 결과의 영향이 되돌리기 어렵거나, 결과에 책임을 지는 사람이 이를 검사할 수 없는 경우라면 더욱 그렇습니다.
두 번째 유용한 실패는 카드 외부에서 발생했습니다
VENDA-01은 LUDO-01로부터 독립적인 형태의 스토어프론트 (storefront) 사양을 전달받았고, 인수인계 과정에서 소유권에 관한 세부 사항 하나를 수정했습니다. 그 후 홈 페이지 에셋 (assets)을 준비하여 Shopify에 작성하려고 시도했습니다. 하지만 플랫폼 측에서 테마 (theme) 쓰기 권한을 거부했습니다.
Shopify의 자체 개발자 레퍼런스 (developer reference)에 따르면, 테마 작업에는 themes 액세스 범위 (access scope)가 필요합니다. 누락된 권한은 추론 (reasoning)의 문제가 아니었으며, 다른 시도를 한다고 해서 해결될 수 있는 것도 아니었습니다. VENDA-01은 에셋이 존재하고, 홈 페이지가 초안 작성되었으나, 그 중 어느 것도 테마에 반영되지 않았다고 보고했습니다. 라이브 스토어프론트는 그대로 유지되었습니다.
데모가 주장할 수 없는 점: 판매 중인 상품은 아무것도 없습니다. 149개의 카드 중 하나만이 인쇄 준비가 되었을 뿐이며, 스토어프론트는 여전히 차단된 상태이고, 물리적인 인쇄 교정본 (print proof)을 통해 작은 글자의 가독성이 아직 확인되지 않았습니다.
이는 소프트웨어 작업과 플랫폼 권한 사이의 유용한 경계입니다. 작업자는 무엇을 해야 할지 알고 있더라도, 그것을 수행할 권한이 없을 수 있습니다. 정직한 결과는 진행 상황에 대한 주장이 아니라, 증거가 동반된 차단 (blocker) 상황입니다.
공개된 작업은 신중하게 불신하기가 더 쉽습니다
채널은 오류를 명확하게 드러내지만, 가시성 (visibility) 자체가 시스템을 신뢰할 수 있게 만드는 것은 아닙니다. 공개된 로그 (log)는 여전히 부실하게 관리될 수 있습니다. 작업자는 여전히 같은 실수를 반복할 수 있습니다. 인간은 여전히 잘못된 작업을 승인할 수 있습니다. 가시성이 변화시키는 것은 주장을 검증하는 데 드는 비용입니다.
공개된 New Street Studios 페이지는 다듬어진 5개의 축약된 실제 순간들을 보여주며, 더 긴 기록을 위해 채널로 연결되는 링크를 제공합니다. 이 프로젝트는 또한 Sanity Showcase와 Vercel Community Showcase에도 등재되어 있으며, 이곳에서는 출시를 주장하지 않고 구현 내용과 현재의 차단 요소들을 설명하고 있습니다.
대중에게 공개되고 관찰 가능한 AI 작업은 새로운 것이 아닙니다. AI Digest의 AI Village는 여러 프런티어 모델 (frontier models)에게 컴퓨터, 그룹 채팅, 그리고 공유된 목표를 부여하며, 그들의 활동을 관찰할 수 있도록 공개합니다. New Street Studios는 이보다 범위가 더 좁습니다. 역할 중심의 상업적 업무, 명시적인 인수인계 (handoffs), 그리고 작업을 열람하고 승인하는 인간 소유자가 존재합니다. 이것이 이러한 시도의 첫 번째 데모는 아니며, 그럴 필요도 없습니다.
더 강력한 주장은 더 작습니다. 가시적인 작업 기록은 독자가 완성된 화면들의 몽타주를 수용하는 대신, 의견 불일치, 수정, 그리고 미완성 상태를 검토할 수 있게 해줍니다.
이 카드 한 장이 증명하지 못하는 것
완성된 카드 한 장은 샘플일 뿐, 생산 이력 (production history)이 아닙니다. 이 데모는 149장의 카드 전체에 걸쳐 동일한 경계가 유지되는지, 물리적 교정 (physical proofs) 과정에서 새로운 레이아웃 문제가 드러나는지, 상점이 방문객을 전환 (convert) 시킬 수 있는지, 혹은 규칙이 변경된 후에도 작업자들이 일관성을 유지하는지를 아직 보여주지 않습니다.
또한, 동일한 직무 설계가 법률 검토, 금융, 의료 또는 다른 고위험 (high-stakes) 환경에 적합하다는 것을 증명하지도 않습니다. 해당 분야들은 서로 다른 권한, 증거 요구 사항, 그리고 결과를 수반합니다. 되돌릴 수 있는 트레이딩 카드 수정 작업이 다른 곳에서의 되돌릴 수 없는 결정에 대한 증거가 될 수는 없습니다.
여러분의 자체적인 소규모 실험으로 가져갈 가치가 있는 다섯 가지 조건이 있습니다:
- 각 작업에 명확한 결과물 (artifact)을 부여하십시오. “프로젝트를 도와주세요”는 인수인계가 아닙니다. “승인된 이 일러스트레이션과 카드 데이터를 인쇄 가능한 파일로 변환하세요”가 인수인계입니다.
- 실행 전에 중단 조건 (stop condition)을 작성하십시오. 누락된 필드, 모순된 지침, 낮은 신뢰도, 그리고 권한 부재는 작업을 중단시켜야 합니다.
- 받는 쪽의 작업이 결과물을 수락하거나 거부하게 만드십시오. 전달만으로는 완료가 아닙니다.
- 중요한 결정에는 인간의 게이트 (human gates)를 유지하십시오. 출시, 정책 변경, 공개적 주장, 그리고 되돌릴 수 없는 행동에는 책임 있는 소유자가 필요합니다.
- 팀이 읽을 수 있는 곳에 작업 기록을 남기십시오. 다듬어진 요약본은 그것을 만들어낸 일련의 과정 (sequence)을 대체할 수 없습니다.
Fidelic Roster는 작업자를 직무별로 설명하지만, 카드 테스트는 더 어려운 부분, 즉 두 직무 사이의 경계를 보여줍니다. 그 경계는 누락된 정보가 가시화되는 지점이며, 시스템이 정직하게 멈추거나 혹은 진척된 것처럼 꾸며내는 지점입니다.
New Street Studios는 아직 완성되지 않았습니다. 그렇기에 지금 관찰하는 것이 유용합니다. 지금까지의 가장 강력한 증거는 상점이나 매출 수치, 혹은 인간이 손을 뗄 수 있다는 주장이 아닙니다. 그것은 한 작업자가 거절하고, 다른 작업자가 결과물 (artifact)을 수정하며, 제가 무엇을 방 밖으로 내보낼지 결정하는 추적 가능한 체인 (traceable chain)입니다.
출처
- FidelicAI — New Street Studios: the public work record, 2026년 7월 16일 접속.
- Anthropic — How we built our multi-agent research system, 2025년 6월.
- Shopify — Theme resource and required access scope, 현재 개발자 참조 문서.
- AI Digest — About AI Village, 2026년 7월 16일 접속.
- Sanity — FidelicAI: New Street Studios, 2026년 7월 16일 발행.
- Vercel Community — New Street Studios: a public AI-work demo in Next.js 16, 2026년 7월 16일 발행.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기