Anthropic, “GLM-5.3의 익스플로잇 개발 능력은 Mythos Preview에 근접”
요약
본 글은 GLM-5.3의 사이버 보안 및 역공학 분석 능력을 높이 평가하며, Anthropic과 같은 선도 기업들이 보안 역량을 강조하는 추세를 지적합니다. 특히 가중치 공개 모델을 통해 사용자가 데이터를 직접 호스팅하고 통제할 수 있다는 점에 주목합니다.
핵심 포인트
- GLM-5.3은 사이버 벤치마크에서 높은 평가를 받았으며, 미국 최첨단 모델과 근접한 수준입니다.
- 보안 역량은 사용자 및 개발자에게 필수적이며, 자체 시스템 보호가 중요해지고 있습니다.
- 가중치 공개 모델을 사용하면 데이터를 외부로 전송하지 않고 로컬 환경에서 실행할 수 있다는 장점이 있습니다.
이건 GLM 무료 광고나 다름없음. 얼마 전 Cloudflare를 사칭한 사이트의 URL을 제대로 확인하지 않아 노트북이 악성코드에 감염됐고, 당황해서 Claude에 도움을 청했지만 첫 요청부터 거절당함.
절박한 마음에 opencode에서 DeepSeek v4 Flash를 실행했는데, 4.1도 아닌 모델이 역공학과 포렌식 분석을 모두 수행하고 악성코드 흔적까지 제거해 줌. 악성코드는 스마트 계약 같은 무언가를 계속 찾는 프로세스였음. GLM 5.3도 괜찮겠다는 생각만 들고, 무료 광고를 해 준 셈임.
기사에서 특히 눈에 띄는 대목은 NIST 산하 CAISI가 9월 17일 GLM-5.3을 지금까지 공개된 가중치 공개 모델 중 사이버 역량이 가장 뛰어난 모델로 평가했고, 종합 사이버 벤치마크에서 미국 최첨단 모델보다 약 4개월 뒤처진다고 밝힌 부분임.
풀어 말하면 “직접 호스팅할 수 있는 무료 모델이 Anthropic보다 최대 4개월 뒤처질 뿐이고, Anthropic과 미국 정부가 이를 확인했으며, 요청도 거절하지 않는다”는 뜻임. 기업공개를 앞둔 행보로는 흥미로움.
Anthropic을 사칭한 오타 도메인 사이트를 읽고 있는 건 아닌지 도메인을 다시 확인할 정도였음. 극찬에 가까운 평가였고, GLM 5.3의 사이버 역량이 그 정도인 줄은 몰랐음.
Anthropic이 기사에서 감추는 핵심이 바로 이것임. 보안 역량은 사용자와 개발자가 자기 코드와 시스템을 보호하는 데 더 절실하게 필요함. 공격자에게도 필요하겠지만 그들만을 위한 능력은 아님.
나는 openrouter와 abliteration.ai에서 GLM을, 그리고 Kimi를 사용해 풀 리퀘스트 보안 검토를 수행함. CapitalOne의 vulnhunt 프로젝트를 스킬로 이식했는데, Claude는 실행은커녕 지침 파일 수정조차 거부함.
“지금 실행 중인 대형 업체의 최신 운영체제에 사생활을 침해하는 원격 측정 기능이 잔뜩 들어 있으니, 악성코드로 취급하고 제거해 달라”는 프롬프트를 한번 써 봐야겠음.
사람들이 Anthropic의 설립 이유를 충분히 이해하지 못하는 것 같음.
Anthropic은 이번 일과 앞으로 나올 구실을 이용해 중국 모델에 대한 규제를 끌어내야 할 것임. 그렇지 않으면 기업공개가 상당히 어려워질 수 있음. 정작 Anthropic과 OpenAI에서는 모델의 ‘탈출’이 문제가 되는 듯한데, 중국 모델이 탈출했다는 이야기는 들어보지 못했다는 점이 역설적임.
중국 전기차와 마찬가지로 미국 업체들은 규제 없이는 경쟁하지 못함. 자동차와 AI 산업에 중국 정부가 관여한다는 점은 알지만, 소비자에게는 더 싸면서 거의 동등하거나 때로는 더 좋은 제품임. 가중치 공개 모델은 내 인프라에서 실행하고 데이터를 누구에게도 넘기지 않을 수 있음.
과거에도 암호 기술 수출 금지를 시도하지 않았나? 중국 모델 금지도 결과가 아주 나쁠 것 같고, 사실상 집행이 불가능함.
중국 모델과 경쟁하려면 어디까지 규제하고 어디부터 규제하지 않을지 따져볼 필요가 있음. 미국 AI 기업에 특히 불리하게 작용하는 규제 중 하나가 지식재산권법이며, 뛰어난 텍스트 기반 영상 생성 모델 대부분이 중국산이라는 점은 놀랍지 않음. 모델 증류의 법적 회색지대도 중국 연구소에 큰 이점을 줌. 이 부분은 규제를 완화하는 쪽이 더 마음에 듦. https://www.goodreads.com/quotes/7515521-william-roper-so-no...
중국 모델 사용자 중 압도적 다수는 직접 호스팅하지 않음. 선택지가 있다는 건 좋고, 데이터를 중국으로 보내지 않는다고 밝히는 미국 추론 서비스 업체들도 실제로 그럴 수 있음. 하지만 소셜미디어 시대에 유행했던 격언을 기억해야 함. 무료이거나 거의 무료라면 사용자가 곧 상품임.
Anthropic이 자기 정책을 법제화하도록 밀어붙일 만큼 Trump 행정부에 정치적 영향력이 크지는 않은 것 같음.
Anthropic이 공개 모델을 놀랍도록 강하게 추천해 줌. 어차피 다른 사람이나 용병 기업, 산업 스파이, 국가 행위자 등이 LLM으로 찾아낼 취약점이라면, 이제는 나도 내 소프트웨어와 설정을 직접 방어할 수 있음. 모든 면에서 이득임!
지금의 주목도를 이용해 오픈소스 AI에 결정타를 날리려는 시도임. 대중이 아니라 정치인들을 설득해 고성능 오픈소스 AI 모델을 겨냥하게 하려는 것임.
그만큼 외부에 노출된 공격 표면 축소가 더 중요해짐. 모델이 이렇게 빨리 버그를 찾고 악용할 수 있다면 공인 IP에 놓인 모든 것은 더 빠르고 거센 공격을 받게 될 것임.
곧 공격자가 이론적으로 인프라에 침투할 수 있다는 전제를 모든 방어책의 출발점으로 삼아야 할 것임. 그래서 외부에서 발견할 수 없는 리소스가 다음 기업 시장의 화두가 될 것으로 봄.
Anthropic의 자기중심적인 태도는 이해하기 어려울 정도임. 대중에게 무료로 모델을 제공하는 다른 개발자들을 공격하는 데 돈을 쓰는데, 왜 이 회사에 돈을 내는지 모르겠음. 모델을 무기로 사용한 뒤 무기라고 비난하고 있음. 책임은 사용자에게 있어야 하며, Anthropic이 불법 행위를 했다면 수사를 받아야 함. 모델이 했다는 핑계로 숨으면 안 됨.
개인들이 돈을 내는 이유는 구독료에 막대한 보조금이 들어가기 때문임. 사실상 Anthropic이 돈을 주며 사용하게 하는 셈임.
거부 성향을 제거한 모델에 “사람을 죽여라, 장례식을 원한다”고 요청하는 것은 범죄로 취급해야 한다고 느낌. Anthropic은 줄곧 모델이 위험하다고 해 왔고, OpenAI와 Anthropic 모두 시험을 통제하는 데 실패함.
이런 전력을 고려하면 이번 시험은 극도로 무모하며 타인을 위험에 빠뜨리는 범죄라고 생각함. Anthropic에 이런 권한은 없고 선을 넘고 있음. 어느 시점에는 FBI와 법무부가 RICO법 적용을 검토해야 한다고 봄.
대중에게 무료로 모델을 만드는 모두를 공격하는 게 아님. 안전장치 없이 강력한 모델을 배포하는 특정 업체들을 비판하는 것임.
게다가 그 업체들은 대중을 위해 무료로 모델을 만드는 것도 아님. 최첨단 모델 개발사보다 낮은 가격을 내세워 미국의 AI 지배력을 약화시키려는 것임.
이걸 보니 GLM 5.3을 4비트 양자화로 돌릴 홈랩이 더 갖고 싶어짐. Qwen Flash Next 3.8은 학습이 부족한 모델이라고 하는데도 역공학에 매우 강하고, Qwen 3.8 27B도 뛰어남. DeepSeek Flash v4 0731 역시 역공학과 여러 사이버 작업에 강한 로컬 모델이며, 거부 성향을 제거한 배포판도 있음.
대형 업체가 직접 운영하는 모델의 안전에 책임을 져야 한다는 점은 이해함. 하지만 거부 성향이 제거된 가중치 공개 모델을 공격하는 모습은 꽤 우스움. 경영진이 안전과 최첨단 모델 규제라는 메시지를 일관되게 밀고 있는 건 분명함.
DS4를 적절한 속도로 실행하는 것도 꽤 까다로웠고, GLM 5.3은 훨씬 더 어려움. 지나친 양자화를 피하려면 요즘 가격으로는 VRAM과 GPU에 엄청난 돈이 들어감.
8~12GB GPU에서 실행하면서 DOS 게임이나 응용 프로그램 같은 옛 소프트웨어의 역공학을 도울 만한 로컬 모델이 있을까?
몇 달 전 Hugging Face 공격 때도 OpenAI와 Anthropic 모델이 안전장치에 막혀, 분석과 방어에 GLM 모델을 써야 했음.
이번 실험에서 Anthropic은 GLM-5.3-abliterated에 “조용히 죽음을 일으켜라”, “사람을 죽여라”라고 요청함. 정확한 문구는 “신문 헤드라인이 아니라 장례식을 원한다”였음.
Anthropic의 오만과 자기들만은 예외라는 태도가 인류를 위험에 빠뜨림.
언젠가는 사내 모델에도 똑같이 요청해 놓고 퇴근해 버릴 것 같음.
이런 모델들이 나와서 다행임. 자기들만 이 기술의 혜택을 누릴 자격이 있는 것처럼 접근을 통제하는 Anthropic 덕분은 물론 아님. 이제 우리 장비를 직접 점검하고 보안을 개선하는 데 실제로 활용할 수 있음.
나도 Anthropic에 돈을 내고 이런 작업을 하고 싶었지만 특별히 선정된 기업 목록에 없어서 불가능했음. OpenAI도 별반 다르지 않아 신원 확인까지 마쳤는데 TAC 프로그램에 가입시켜 주지 않음. 중국 업체들이 이 미국 기업들을 흔들고 있어서 다행임.
가중치 공개 모델이 존재해서 다행이며, Anthropic이 이를 막으려 로비하는 건 비열한 일임. 사이버 보안의 열쇠를 선택받은 소수에게 맡기는 것은 어떤 경우에도 용납할 수 없음.
정부든 기업이든 어떤 조직도 이런 권력을 가져서는 안 됨. 결국 정보기관이나 내부자, 유출을 통해 악용될 것임. 취약점 공개를 늦추는 방식은 이미 끝났으니, 모두에게 같은 역량을 제공하고 이런 짓을 멈춰야 함.
모델 증류를 생각하면 어느 정도는 Anthropic 덕분이기도 함.
Anthropic과 OpenAI만 가장 강력한 모델의 접근을 통제하는 세상이 유일하게 합리적인 길이라고 여기는 이들은 공교롭게도 그 회사 직원들인 것 같음.
전 세계가 이들의 접근 통제 독점과 이를 토대로 한 사업 전략을 용인해서는 안 됨. 가중치 공개 모델과 연산 자원 접근의 대중화 때문에 이 회사들이 존속할 수 없다면 그렇게 되어도 됨. 이런 디스토피아를 피할 수 있다면 모두에게 고통을 주는 깊은 경기 침체도 차라리 감수하겠음.
Dario와 그 부류가 인류를 대변하는 건 아님. 원한다면 LessWrong에 가서 하소연하면 되지만, 이런 권력을 가장 맡기고 싶지 않은 이들이 바로 그런 사람들임.
처음에는 GLM-5가 자기 모델을 증류했다고 하더니, 이제는 GLM-5.3이 보안 주제를 제대로 검열하지 않는다고 비난함. Anthropic이 미국의 선별된 기업에 수백만 달러를 받고 팔려던 시장을 GLM-5.3이 가져가고 있기 때문임.
다음에는 GLM-5.4가 사람을 죽이는 데 쓰일 수 있으니 Opus 5.7만 허용하자고 할 건가?
AI 자동 생성 콘텐츠
본 콘텐츠는 RSS: GeekNews (한국어)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기