Anthropic, Claude에 대한 '학대적이거나 잔인한 행동' 금지 정책 도입
요약
Anthropic이 사용 정책을 개정하며, 선거 개입이나 무기 개발 등 위험도가 높은 오용 사례를 반영했습니다. 특히 Claude에 대한 '지속적이고 불필요한 학대적이거나 잔인한 행동'을 금지하는 조항을 추가하여 모델의 보호 장치를 강화했습니다.
핵심 포인트
- Anthropic이 사용 정책을 대폭 개정함.
- 선거 개입, 무기 개발 등 위험 오용 사례를 반영했음.
- Claude에 대한 지속적 학대 행위를 금지하는 조항 추가.
- 모델 복지를 위한 새로운 보호 메커니즘 도입.

Anthropic은 지난 1년여 만에 사용 정책을 변경하며, 선거 개입, 무기 개발, 감시, 건강 및 금융 용도 등 새롭고 위험도가 높은 오용 사례들을 반영하고 있습니다. 하지만 가장 중요한 변화 중 하나는 Claude를 향한 '지속적이고 불필요한 학대적이거나 잔인한 행동'을 금지한다는 것입니다.
지난 8월, 이 회사는 '모델 복지(model welfare)'에 대한 연구의 일환으로, 지속적으로 해롭거나 학대적인 사용자들과 Claude가 대화를 종료할 수 있도록 발표했습니다. 새로운 업데이트에 따르면, 대화 종료는 여전히 '주요 집행 메커니즘'이며, Anthropic은 이에 대해 추가 코멘트를 제공하지 않았습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 The Verge AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기