보안의 언어: 프롬프트 구문이 Open LLMs의 안전한 코드 생성에 미치는 영향
요약
본 논문은 프롬프트의 미세한 구문적 구성 요소들이 open LLMs가 생성하는 코드의 보안에 미치는 영향을 연구했습니다. 파서 기반 접근 방식을 통해 다양한 구문 변형을 체계적으로 생성하고, 여러 open LLM 및 언어 전반에서 그 영향이 코드 보안에 미치는 것을 평가했습니다. 이 결과는 특정 구문 요소와 위치가 불안전한 코드 생성 가능성에 일관되게 영향을 준다는 점을 보여줍니다.
핵심 포인트
- 프롬프트의 미세한 구문 변형이 코드 보안에 큰 영향을 줌.
- 파서 기반 접근으로 체계적인 구문적 변형 테스트를 수행함.
- 특정 구문 요소(제약 조건, 가드 등)와 위치가 취약점 위험을 결정함.
- LLM 지원 개발에서 실질적인 보안 제어 지침을 제공함.
대규모 언어 모델(LLMs)은 출력물에서 보안 취약점을 자주 보임에도 불구하고 소스 코드 생성에 점점 더 많이 사용되고 있습니다. 이전 연구들은 프롬프트 엔지니어링이 이러한 위험을 완화할 수 있음을 보여주었지만, (1) 주로 고수준의 프롬프팅 전략에 초점을 맞추어 미세한 구문적 변형이 모델 동작을 상당히 바꿀 수 있다는 최근 증거를 간과했으며; 그리고 (2) 독점 LLM(proprietary LLMs)을 주로 평가하여, 개인 정보 보호, 규정 준수 및 배포 제어를 위해 자체 호스팅되는 오픈 모델(open models)이 선호되는 산업 환경에서의 연구 결과 적용 가능성을 제한했습니다. 본 논문에서는 프롬프트의 미세한 구문 구성 요소들이 open LLM이 생성한 코드의 보안에 어떻게 영향을 미치는지 연구합니다. 파서 기반 접근 방식을 사용하여, 우리는 보안 관련 코드 생성 프롬프트의 구문적 변형들을 체계적으로 생성하고, 여러 open LLMs 및 프로그래밍 언어 전반에 걸쳐 그 영향이 코드 보안에 미치는 영향을 평가했습니다. 우리의 결과는 제약 조건(constraints), 가드(guards), 조건(conditions), 개념 바인딩(concept bindings)과 같은 특정 구문적 요소와 그 위치가 불안전한 코드를 생성할 가능성에 일관되게 영향을 미친다는 것을 보여줍니다. 이러한 발견들은 프롬프트 구문을 구체적인 보안 제어 표면(security control surface)으로 식별하며, LLM 지원 개발에서 취약점 위험을 줄이기 위한 실행 가능한 지침을 제공합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 arXiv Codex (cs.SE)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기