Anthropic Frontier Red Team의 평가 결과
요약
Anthropic Frontier Red Team이 내부 바이너리 익스플로잇 벤치마크를 통해 여러 모델의 취약점을 평가했습니다. GLM-5.3은 시도 중 4%에서 완전한 제어 흐름 하이재킹을, Claude Mythos Preview는 6%를 달성하며 성능 향상을 보였습니다. 특히 이전 세대 모델들이 실패했던 임계점을 넘어서고 있다는 점이 중요합니다.
핵심 포인트
- GLM-5.3은 내부 바이너리 익스플로잇에서 4%의 성공률을 기록했습니다.
- Claude Mythos Preview는 6%의 제어 흐름 하이재킹 달성률을 보였습니다.
- 최신 모델들은 이전 세대 대비 명확한 성능 임계점을 넘어서고 있습니다.
2026년 9월 29일
우리는 [내부 바이너리 익스플로잇(Binary Exploitation) 벤치마크]에서 무작위로 선택된 100가지 과제에 대해 여러 모델을 평가했으며, GLM-5.3이 시도 중 4%에서 완전한 제어 흐름 하이재킹(full control flow hijacks)을 개발하는 것을 발견했습니다. Claude Mythos Preview는 이 수치를 6%로 달성했습니다. 비록 GLM-5.3이 여기서 Claude Mythos Preview보다 성능은 낮지만, 의미 있는 임계점(meaningful threshold)이 명확하게 넘어서고 있습니다: 이전 모델들, 예를 들어 Claude Opus 4.6과 GLM-5.2는 이 중 어느 것에서도 성공하지 못했습니다.
— Anthropic Frontier Red Team, GLM-5.3 및 고급 사이버 역량의 확산
최근 기사
- 거의 모든 것에 기본 하드 예산 상한선(default hard budget caps)이 필요할 것 같다 - 2026년 10월 3일
- OpenAI DevDay 2026 라이브 블로그 - 2026년 9월 29일
- LLM의 2026년 (지금까지) - 2026년 9월 27일
AI 자동 생성 콘텐츠
본 콘텐츠는 Simon Willison Blog의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기