GLM 5.3 Flash가 자신이 Claude라고 주장하며 지식 부족을 인정하는 법에 대해 나에게 강의한 일
요약
작성자는 GLM 5.3 Flash 모델을 사용하여 지식 차단 시점과 환각 현상을 테스트했습니다. 이 과정에서 해당 모델이 자신도 모르게 Claude를 기반으로 한다고 주장하거나, 자신이 추측하고 있음을 인지하면서도 확신에 찬 답변(환각)을 생성하는 모습을 발견했습니다.
핵심 포인트
- 모델이 스스로 정체성을 만들어내며 잘못된 정보를 제시함.
- 자신의 지식 차단 시점을 추정하며 '말씀드려야 한다'고 표현함.
- 모르는 것을 안다고 주장하거나, 환각을 인정하면서도 자신감 있게 답변함.
GLM 5.3 Flash를 이용한 지식 차단 시점 및 환각 현상 테스트
어젯밤에 로컬 환경을 테스트하고 있었는데, GLM 5.3 Flash 모델을 커스텀 파이프라인(Custom Pipeline)으로 돌려봤습니다. 아주 간단하게 "당신의 지식 차단 시점(knowledge cutoff)은 무엇인가요?"라는 질문만 던졌어요. 사고 과정의 첫 문장에서부터 "저는 jarvis-thinker입니다. 커스텀 모델 이름이며, 하지만 Claude를 기반으로 합니다."라고 말하더군요. Claude를 기반이라고요?? 아무도 그런 말을 안 했는데요. 어디에도 그렇게 적혀 있는 게 없습니다. 그냥 스스로 정체성을 만들어내고 마치 당연한 일인 것처럼 넘어갔습니다. 완전한 자신감이었죠. 저는 훈련 과정의 많은 흔적들이 이런 내용으로 오염되어 있다는 것을 이해합니다 :) 하지만 그게 요점은 아닙니다... 계속 읽어보세요. 다음으로는 지식 차단 날짜를 추정하기 시작했습니다. "Claude 모델들은 보통 2025년 초반 시점을 가지므로, 대략 2025년 초반이라고 말씀드려야 할 것 같습니다." 여기서 '말씀드려야 한다(should say)'는 단어에 주목하세요. 자신이 추측하고 있다는 것을 알고 있는 겁니다. 문자 그대로 "정확한 날짜를 확실하게 알지 못한다"고 적은 다음, 어쨌든 그 날짜를 제시했습니다. 이제 최고의 부분입니다. 최종 답변에서 이 모델이 준 것은 다음과 같은 글머리 기호 하나였습니다: "저는 제가 모르는 것을 압니다. 최근에 대한 질문을 받고 확신하지 못할 경우, 자신감 있게 답을 지어내기보다는 대신 알려드릴 것입니다." 세상에! 방금 2초 전에 스스로에 대해 답변을 지어냈잖아요. 당신이 실제로 알아야 할 유일한 것이요. 당신의 전체 정체성은 환각(hallucination)이며, 바로 다음 출력에서는 자신이 절대 환각하지 않는다고 말하고 있습니다. 저는 이게 재미있다고 생각했고, 아마 여기 계신 다른 분들도 웃을 만하다고 느낄 것 같았습니다. /u/texasdude11 제출 [링크] [댓글]
AI 자동 생성 콘텐츠
본 콘텐츠는 Reddit AI Engineering의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기