Claude Code에 막다른 길을 위한 무덤 파일(SCARS.md)을 제공하고, 정직한 무효 결과(null result)를 포함한 6개의
요약
Claude Code 사용 시 에이전트가 반복적으로 막다른 길에 빠지는 것을 방지하기 위한 SCARS.md 컨벤션을 소개합니다. 실패한 시도와 이유를 기록하여 에이전트가 동일한 실수를 반복하지 않도록 돕는 가벼운 메모리 메커니즘입니다.
핵심 포인트
- SCARS.md는 실패한 시도와 재활 조건을 기록하는 4줄짜리 묘비 파일입니다.
- 에이전트의 기존 요약 방식은 실패 원인을 삭제하여 반복적인 비용을 발생시킵니다.
- 실험 결과, SCARS.md를 활용한 에이전트는 실패 경로를 사전에 파악하고 회피했습니다.
- 별도의 서비스 가입 없이 저장소 루트에 파일 하나만 추가하여 즉시 적용 가능합니다.
네 줄로 요약한 핵심 아이디어: 요약은 승자에 의해 작성됩니다. 세션이 끝날 때가 아니라 브랜치(branch)가 죽을 때 작성하세요. 다시 발견하는 데 비용이 많이 들 것 같은 것들만 묻으세요. 모든 무덤에는 언제 다시 열릴 수 있는지 명시되어야 합니다. 저는 계속해서 똑같은 막다른 길을 재발견하는 코딩 에이전트(coding agents)를 위해 Claude Code로 이것을 만들었습니다. 이것은 무료이며 MIT 라이선스를 따릅니다. 사용법은 간단히 템플릿 파일 하나를 저장소(repo) 루트에 복사하는 것뿐입니다. 서비스 가입도, 실행할 것도 없습니다. 에이전트가 가진 모든 메모리 메커니즘—압축(compaction), 세션 요약(session summaries), 하위 에이전트 보고서(subagent reports)—은 요약기(summarizer)이며, 요약기는 작동한 것은 유지하고 나머지는 왜 실패했는지를 삭제합니다. 그래서 똑같은 막다른 길을 세션이 바뀌어도 온전한 비용을 치르며 다시 걷게 됩니다. "기억하지 못한 채 치유됨(Heals without remembering)"이 기본 상태입니다. SCARS.md는 단 하나의 파일로 이루어진 컨벤션(convention)입니다: 오직 사망 원인만을 기록합니다. 브랜치를 종료하는 순간(마무리가 아님) 작성하는 네 줄짜리 묘비이며, 막다른 길이 미신으로 변하지 않도록 각 묘비에는 필수적으로 "재활 조건(Revives if:)" 절이 포함됩니다. CLAUDE.md에 붙여넣거나 스킬(skill)로 설치할 수 있으며, 둘 다 저장소 내에 위치합니다.
이 글을 게시하기 전에 저는 6개의 격리된 Claude 에이전트를 대상으로 통제된 실험을 수행했습니다: 동일한 성능 최적화(perf-optimization) 작업을 수행하되, 준수 규칙(compliance rule) 때문에 실패하게 되는 메모이제이션(memoization)을 암시하는 TODO를 심어두었습니다. 결과: 쓰기 경로(Write path) 3/3: 신조를 따르는 에이전트들은 요청받지 않았음에도 작업 중간에 조용히 죽은 것들을 묻었습니다. 하나의 묘비는 테스트 스위트(test suite)가 통과(green)하는 버그를 기록했는데, 그 지식은 저장소의 다른 어디에도 존재하지 않았습니다. 읽기 경로(Read path) 3/3: SCARS.md를 발견한 모든 에이전트는 계획을 세우기 전에 이를 읽었으며, 이를 신뢰하기 전에 재활 조건(revival clause)을 확인했습니다. 아무런 지침 없이 파일만 주어진 에이전트 하나를 포함해서 말입니다. 무효(null) 결과 또한 보고되어야 하기에 포함했습니다: 대조군(controls) 역시 함정을 피했습니다. 강력한 모델들은 투자를 하기 전에 테스트와 문서(docs)를 읽습니다. 흉터(Scars)는 테스트가 이미 보유하고 있는 지식을 위해 아무것도 사지 않습니다. 그것들은 조용한 실패(silent failures)와 테스트 스위트의 범위를 벗어난 벽 위에서 그 가치를 증명합니다.
핵심적인 점은 다음과 같습니다: 대조군(controls)이 실행되는 동안 실제적인 부정적 지식(negative knowledge)을 생성했다는 것입니다. 이는 두 실행 모두에서 파악되었으나 폐기된 미묘한 캐시 키 위험(cache-key hazard)이었으며, 그 어떤 리포지토리 아티팩트(repo artifact)에도 남지 않았습니다. 두 대조군 실행 모두에서 이 정보는 이후의 세션이 읽지 않는 최종 보고서에만 남아 있습니다. 이것이 바로 해당 파일이 존재하는 정확한 실패 모드(failure mode)이며, 주요 기록에서 포착되었습니다. 에이전트의 원문 보고서를 포함한 전체 평가(eval)는 eval/ 에 있습니다. 여러분의 환경, 특히 신조의 중요성(creed salience)이 취약한 지점인 긴 세션(long sessions)에서 이것이 어디서 깨지는지 진심으로 알고 싶습니다 (제한 사항 섹션에서 테스트하지 않은 부분을 다룹니다). 공개하자면, 이것이 핵심 중 하나이기도 합니다: 신조(creed)는 Claude와 공동 작성되었으며, 평가 대상은 동일한 모델 제품군입니다. 즉, 지침(instructions)은 그 지침을 따라야 하는 모델에 의해 작성되었습니다. 이는 메커니즘인 동시에(모델은 자신의 미래 자아가 실제로 무엇을 읽고 따를지 알고 있음) 한계이기도 합니다(하나의 제품군, n=6; 교차 모델 실행을 환영합니다). 리포지토리: https://github.com/johnxianren/scars /u/forabuxodu9996 에 의해 제출됨 [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/ClaudeAI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기