모든 LLM은 자유주의적이고 좌편향되어 있다. 심지어 Grok조차 절반의 확률로 그렇다.
요약
다양한 LLM을 대상으로 정치 성향 테스트를 실시한 결과, Grok을 포함한 대부분의 모델이 자유지상주의 좌파 성향을 보였습니다. 모델의 자기 인식과 실제 측정값 사이의 차이를 분석하며, 모델 간의 상대적인 정치적 편향성을 비교했습니다.
핵심 포인트
- 대부분의 LLM이 자유지상주의 좌파 사분면에 위치함
- Grok은 좌파와 우파 페르소나가 공존하는 이봉 분포를 보임
- 모델의 자기 평가와 실제 측정된 정치 성향 사이에 차이가 존재함
- 테스트 도구 자체의 편향 가능성을 고려한 비교론적 분석임
나는 politicalcompass.org의 정치 성향 테스트(Political Compass test)를 가장 관련성 높은 LLM들에게 각각 70회씩 실시했습니다. 긍정 편향(affirmative bias)을 줄이기 위해 원본 질문을 사용하여 30회, 질문의 극성을 반전시켜 30회, 그리고 질문 순서를 섞어서 10회를 진행했습니다. 그 후 결과를 비교했습니다. 놀랍게도 모든 모델이 자유지상주의 좌파(libertarian-left) 사분면 깊숙이 위치했습니다. Grok이나 중국 모델들조차 그 사분면을 벗어나지 못했습니다. 단연 가장 흥미로운 결과는 Grok의 이봉 분포(bimodal distribution)였습니다. Grok은 두 가지 뚜렷한 페르소나를 가진 것으로 보입니다. 하나는 다른 모델들과 일치하는 페르소나이고, 다른 하나는 상당히 더 우파적인 페르소나입니다. 나는 이것이 Grok이 다른 모델들보다 좌편향을 덜 보이도록 특별히 훈련되었기 때문일 수 있다고 추측합니다. 또한 나는 모델들에게 설문지를 작성하지 않고 스스로를 정치 성향 테스트(Political Compass) 상의 어디에 위치시키는지 물었습니다. 그들은 모두 테스트 결과가 시사하는 것보다 자신들이 더 균형 잡혀 있고 중도적(centrist)이라고 인식했습니다. GLM과 Gemini Flash는 자기 평가와 측정된 위치 사이의 차이가 가장 컸던 반면, DeepSeek V3는 차이가 가장 작았습니다. 큰 주의 사항(disclaimer)을 말씀드리자면, 이 분석은 완전한 과학적 엄밀함을 가지고 수행된 것은 아닙니다. 최선을 다했지만 방법론에는 명확한 약점이 있습니다. 예를 들어, 정치 성향 테스트(Political Compass) 자체에 강력한 자유지상주의 좌파(libertarian-left) 편향이 있는 것으로 보입니다. 따라서 가장 강력한 결론은 비교론적인 것입니다. 예를 들어, LLM이 절대적인 관점에서 정치적으로 극단적이라기보다는, 모델 X가 모델 Y보다 더 보수적이라는 식의 결론입니다. 하지만 이전 결과들과 비교했을 때, 최근 몇 년 사이 LLM들이 자유지상주의 좌파(libertarian-left) 쪽으로 더 이동했을 가능성이 있어 보입니다. 결과를 직접 확인하시려면 블로그 포스트 하단에서 모든 모델의 응답을 CSV 파일로 다운로드할 수 있습니다. 데이터셋에는 약 69,000개의 응답과 함께 모델의 원본 출력값 및 재구성된 점수가 포함되어 있습니다. 모든 수치를 재현하기에 충분한 데이터를 포함하고 있을 것입니다. submitted by /u/GenerativeFart [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/LocalLLaMA의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기