연구진은 모든 주요 LLM(Large Language Model)이 비밀리에 일본에 집착하고 있음을 증명했습니다.
그리고 그들은 마침내 그 이유를 알아냈습니다.
수년 동안 우리는 AI가 완전히 서구 중심적이며, 실리콘밸리와 미국의 가치만을 반영한다고 들어왔습니다.
Cardiff와 Basque 연구진의 획기적인 논문은 ChatGPT, Claude, Gemini와 같은 프런티어 모델(frontier models)을 대상으로 24개 언어에 걸쳐 31,680개의 문화적 프롬프트(prompts)를 테스트했습니다.
그 결과는 그러한 가정을 산산조각 냈습니다.
8개의 프런티어 모델 중 6개에서, 개방형 문화 질문을 받았을 때 일본이 가장 빈번하게 언급되는 단일 국가로 나타났습니다.
개방적인 맥락에서 전통 무용, 축제 또는 일상적인 관습에 대해 물으면, AI는 일본을 기본값으로 선택합니다.
반복해서 말이죠.
여기 아무도 예상하지 못한 반전이 있습니다.
이러한 편향은 가공되지 않은 사전 학습(pre-training) 인터넷 데이터에서 오는 것이 아닙니다.
연구진은 이 집착이 어디에서 형성되는지를 추적했습니다. 이는 사전 학습 이후, 인간이 AI에게 행동 방식을 가르치는 지도 미세 조정(supervised fine-tuning) 및 정렬(alignment) 단계에서 나타납니다.
왜 일본일까요?
수십 년간의 글로벌 소프트 파워, 풍부한 문화 수출, 그리고 깨끗하고 보편적으로 찬사를 받는 디지털 아카이브 덕분에 일본 문화는 AI 안전 필터(safety filters)가 의존하기에 독보적으로 "안전"하기 때문입니다.
연구소들이 모델을 해롭지 않고 보편적으로 즐거움을 주는 방식으로 훈련할 때, AI는 문화적 측면에서 '컴포트 푸드(comfort food, 위안을 주는 음식)'와 같은 대상을 기본값으로 선택합니다.
애니메이션, 스시, 전통에 대해 이야기함으로써 논란을 피하는 것입니다.
Beledarian/Beledarians_LM_Studio_Toolbox는 LLM에 풍부한 도구 세트를 제공하는 LM Studio용 플러그인입니다. 이 툴박스는 로컬 환경과 LLM 간의 다리 역할을 하며, 자율적인 코딩, 연구 및 파일 관리를 가능하게 합니다. 파일을 생성, 읽기, 수정하고 배치 처리할 수 있는 강력한 기능을 제공합니다.
Beledarian/Beledarians_LM_Studio_Toolbox는 LLM에 풍부한 도구 세트를 제공하는 LM Studio용 플러그인입니다. 이 툴박스는 로컬 환경과 LLM 간의 다리 역할을 하며, 자율적인 코딩, 연구 및 파일 관리를 가능하게 합니다. 파일을 생성, 읽기, 수정하고 배치 처리할 수 있는 강력한 기능을 제공합니다.