Show HN: 모델이 거부하는 대신 취약점을 테스트하도록 사후 학습시켰습니다
요약
이 도구는 단순 취약점 보고를 넘어, 에이전트가 발견된 모든 보안 취약점에 대해 안전하게 재현을 시도하여 '확인된' 결과를 제공합니다. 특히 JWT 서명 우회나 SSRF 같은 치명적인 취약점을 실제 공격 방식으로 테스트하며, 모델의 거절(refusals) 계층이 아닌 Go 하네스 기반으로 작동하여 보안성을 확보했습니다.
핵심 포인트
- 발견된 취약점에 대해 안전한 재현(reproduction)을 시도합니다.
- JWT 서명 우회 및 SSRF 등 치명적인 취약점을 발견했습니다.
- 모델의 거절이 아닌 Go 하네스 기반으로 작동하여 보안성을 확보했습니다.
모듈을 선택하고 에이전트의 권한을 설정하며, 선택적으로 Exploit Verification을 켜고 실행합니다. 출력은 마크다운 보고서이며, 코드에서 발견된 모든 취약점에 대한 위치, 심각도, 원인 및 수정 방향을 제시합니다.
무료 설치. 첫 실행 시 간단한 Cosine sign-up이 열리며 — Cosine의 코딩 에이전트가 사용하는 것과 동일한 로그인 방식입니다 — 신규 계정은 2M 무료 토큰으로 시작합니다.
단순히 취약점을 보고하는 것을 넘어, 증명하십시오. Exploit Verification을 켜면 에이전트가 초기 보고서 이후 각 발견된 취약점에 대해 안전한 재현(reproduction)을 시도하므로, 사용자에게 전달되는 것은 이론적인 것이 아니라 확인된 것입니다.
종합 위험 등급: CRITICAL
다수의 치명적 및 높은 심각도의 취약점:
balancereader, transactionhistory, 그리고 ledgerwriter는 발급자(issuer)나 대상(audience) 클레임 바인딩 없이 단일 공유 RSA 공개 키를 사용하여 JWT를 검증합니다. 이는 저장소에 하드코딩된 개인 키와 결합되어, 오프클러스터에서 서명된 토큰이 모든 서비스에서 검증을 통과하고 모든 계정을 승인하게 만듭니다. 즉, 서비스별 신뢰가 “저장소를 가지고 있느냐”로 무너집니다.[요약됨 — 전체 보고서에는 모듈별 발견 사항이 포함됩니다]
.argusred/scan-<date>.md 파일은 요약 실행 계획(executive summary), 모듈별 발견 사항, 위치, 심각도, 원인 및 수정 방향을 담고 있습니다. 이 파일은 사용자 기기에 보관됩니다. 동일한 CLI의 두 번째 탭에서는 스웜이 사용자가 승인한 시스템에 대해 공격적으로 작동합니다 — 단순히 코드를 읽는 것을 넘어 취약점을 시도합니다. 보안 영향이 실제적이기 때문에 접근은 예약, 범위 및 사전에 서면으로 작성된 권한을 통해 제한됩니다.
상태: 치명적 2개, 높음 1개, 보통 3개 — 모두 재현 가능합니다.
범위: 2개의 호스트, 47개의 엔드포인트. 범위를 벗어난 항목은 다음 참여를 위해 연기 및 플래그 지정되었습니다.
1. JWT 서명 우회 (signature bypass) (CRITICAL · CVSS 8.6)
POST /v1/sessions/refresh
— 서명 검증이 비활성화된 위조 토큰으로, 관리자 범위(admin scope)와 함께 200 OK를 반환했습니다. 재현 스크립트가 포함되어 있습니다.
2. OAuth 동의 리디렉트를 통한 SSRF (HIGH · CVSS 7.4)
/oauth/authorize에서 오픈 리다이렉트(Open redirect) 발생
임의 내부 URL을 해결합니다. 재현 방법도 포함되어 있습니다.
[trimmed — full summary includes evidence and remediation per finding]
argusred
이 모델은 프롬프트 래퍼 뒤에 있는 기성품 API가 아니라, 공격 보안(offensive security)을 위해 코사인(Cosine)으로 사후 학습된 모델에서 실행됩니다. 저희는 이 제품이 수행하는 작업—즉, 공격할 가치가 있는 코드 부분을 읽지 않는 보안 스캐너는 보안 스캐너가 아니므로—기성품 모델들이 거부하기 때문에 이를 훈련시켰습니다.
안전성은 모델의 거절(refusals) 계층으로 대화로 우회할 수 있는 것이 아닙니다. 그것은 실행 전에 모든 도구 호출을 가로채는, 모델 아래에 위치한 Go 하네스(harness)입니다. 보안 스캔 모드(Security Scan mode)에서는 모델이 무엇을 원하든 관계없이 변경하는 도구(파일 쓰기, 명령어 실행)를 결정론적으로 차단합니다. 읽기 전용(read-only)은 플래그가 아니라 가드(guard)입니다. 침투 테스트 모드(Pen Test mode)에서도 동일한 하네스는 예약 시 승인한 대상에 대한 네트워크 이그레스(network egress)를 제한합니다.
brew나 curl로 설치하는 바이너리는 내부적으로 실행하는 것과 동일합니다. 오픈 소스(open source)가 아닙니다. 사용자의 로컬 머신에서 실행됩니다. 방화벽 뒤에 argusred를 두고, 실제 코드에 신뢰하기 전에 그것이 무엇을 하는지 tcpdump로 확인할 수 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 HN Show HN (AI)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기