APX에서 보안 위험 등급(Security Risk Grades)은 권한 모드(Permission Modes)가 아닙니다
요약
APX는 에이전트의 도구 실행 권한을 제어하는 '권한 모드'와 동작의 위험도를 평가하는 '보안 위험 등급'을 분리하여 운영합니다. 이를 통해 에이전트의 유용성을 유지하면서도 위험한 동작에 대한 보안 통제를 정밀하게 수행합니다.
핵심 포인트
- 권한 모드는 도구 실행 가능 여부(정체성)를 결정함
- 보안 위험 등급은 개별 동작의 심각도(위험성)를 평가함
- 두 계층의 분리를 통해 보안성과 사용성 사이의 트레이드오프 해결
- 모델이 도구 호출 시 직접 위험 등급을 매기는 방식 채택
APX에서 보안 위험 등급(Security Risk Grades)은 권한 모드(Permission Modes)가 아닙니다
권한 토글(permission toggle)은 한 가지 질문에 답합니다: 이 도구를 실행해도 되는가? 하지만 그만큼 중요한 두 번째 질문에는 답하지 못합니다: 지금 이 정확한 동작이 얼마나 위험한가?
이것이 바로 APX가 **권한 모드 (permission mode)**와 **보안 위험 등급 (security-risk grading)**을 두 개의 별도 런타임 제어 장치로 유지하는 이유입니다.
APC는 휴대 가능한 컨텍스트 레이어 (portable context layer)입니다. 이는 프로젝트에 리포지토리 내의 하나의 중립적인 계약을 제공합니다: AGENTS.md, .apc/, 에이전트 파일, MCP 힌트, 스킬 및 기타 지속적인 컨텍스트(durable context)가 이에 해당합니다. APX는 일상적으로 사용하는 런타임 및 툴링 레이어 (runtime and tooling layer)입니다. APX는 해당 계약을 읽고, 에이전트 루프 (agent loop)를 실행하며, 승인, 세션 및 메시지 로그와 같은 런타임 결정 사항을 리포지토리 외부에 유지합니다.
이 주제는 APX 측에 속합니다.
두 개의 게이트, 두 개의 서로 다른 역할
APX는 슈퍼 에이전트 (super-agent)를 위해 세 가지 권한 모드 (permission modes)를 지원합니다:
total: 확인 없이 도구 실행automatico: APX가 자동으로 결정permiso: 허용 목록(allow-listed)에 있는 도구만 직접 실행
이 게이트는 **도구의 정체성 (tool identity)**에 관한 것입니다. 쉘 도구 (shell tool), 파일 에디터 (file editor), Telegram 송신 도구, 또는 MCP 호출은 모델이 무엇을 할지 결정하기도 전에 기본 신뢰 정책 (default trust policy)을 가질 수 있습니다.
APX에는 선택 사항인 security_risk 레이어도 있습니다. 이 레이어가 활성화되면, APX는 각 적격한 도구 스키마 (tool schema)에 필수적인 security_risk 필드를 주입하며, 모델은 도구 호출 (tool call) 자체의 일부로서 해당 동작을 LOW, MEDIUM, 또는 HIGH로 등급을 매겨야 합니다. 별도의 모델 패스 (second model pass)나 별도의 위험 서비스 (separate risk service)는 필요하지 않습니다.
이 게이트는 **동작의 심각도 (action severity)**에 관한 것입니다.
이 둘은 같은 것이 아닙니다.
run_shell과 같은 도구는 ls src에는 무해할 수 있지만 rm -rf build에는 위험할 수 있습니다. 전송 도구는 내부 메모에는 괜찮을 수 있지만 실제 사용자에게 보내는 외부 메시지에는 위험할 수 있습니다. 정적 권한 모드 (Static permission mode) 자체로는 그 차이를 볼 수 없습니다. 위험 등급 (risk grade)은 볼 수 있습니다.
이러한 분리가 중요한 이유
만약 두 개념을 하나의 설정으로 통합한다면, 나쁜 트레이드오프 (tradeoff)를 얻게 될 것입니다.
시스템이 너무 엄격하면, 에이전트(agent)가 사소하지 않은 모든 단계마다 승인을 요청하게 되어 유용성이 떨어집니다. 반대로 시스템이 너무 느슨하면, 하나의 신뢰할 수 있는 도구가 사용자가 예상한 것보다 훨씬 더 위험한 동작을 수행할 수 있습니다.
APX는 다음 두 계층을 모두 유지함으로써 이 문제를 피합니다:
- 권한 모드 (permission mode)는 도구에 대한 기본 정책 (baseline policy)을 결정합니다.
- 보안 위험 등급 (security-risk grading)은 **이 호출 (this call)**을 중단시켜야 하는지 여부를 결정합니다.
가장 흥미로운 사례는 total 모드입니다. APX에서 위험 게이트 (risk gate)는 여전히 안전 바닥 (safety floor) 역할을 합니다. 마찰이 적은 작업은 자유롭게 실행되지만, HIGH 등급으로 분류된 동작은 여전히 확인을 요구할 수 있습니다. 이는 '전부 아니면 전무 (all-or-nothing)' 식의 신뢰 모델보다 더 나은 모델입니다. 왜냐하면
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기