유명 인공지능 기업인 Anthropic은 최근 자사의 AI 도우미 Claude의 사용 정책을 전면적으로 개정했으며, 새로운 규정은 2026년 11월 12일에 공식적으로 시행될 예정입니다. 이 개정에서 가장 주목할 만한 변화 중 하나는 조항에 "지속적이고 불필요한 학대나 잔인한 행위를 금지하는" 명확한 제한을 처음으로 포함시킨 것입니다.
공식 설명에 따르면, 이 규정은 사용자가 명확한 목적 없이 모델에 잦은 잔인한 처리를 하는 경우에 적용됩니다. 구체적인 실행 방안으로는 Anthropic은 현재 대화를 종료하는 방식을 취하고 있지만, 향후 사용자 계정을 금지하거나 다른 더 심각한 처벌을 도입할지는 아직 명확하지 않다고 밝혔습니다. 또한 회사는 이 조항이 사용자의 일상적인 불만, 의문, 어둡은 주제를 포함한 문학 작품, 그리고 규정에 부합하는 모델 보안 테스트 및 연구에는 적용되지 않는다고 강조했습니다.
인간-기계 상호작용 행동을 규범화하는 것 외에도, Anthropic은 여러 핵심 분야에 대한 금지 조치를 확대하고 세분화했습니다:
무기 금지 조치 강화: 무기 관련 금지 조치의 적용 범위가 더욱 확대되어, 무기의 정상적인 작동을 위한 소프트웨어와 구성 요소, 그리고 무장 드론 및 기타 자율 차량의 개발 행위도 포함되었습니다. Anthropic은 이전에 Claude를 이용하여 무기 지시나 제어 소프트웨어를 개발하려는 위반 시도가 여러 건 발견되었다고 밝혔습니다.
강화된 감시 제한: 감시 조항에서는 동의 없이 개인을 추적하는 행위를 명시적으로 금지하며, 실시간 추적이나 기존 데이터 분석도 금지 범위에 포함됩니다. 또한 Claude를 법 집행 및 형사 사법 절차에서의 수사, 체포 또는 기소 대상 결정이나 제안에 사용하는 것도 엄격히 금지되며, 어떠한 감시 도구를 구축하거나 개선하는 데에도 사용되어서는 안 됩니다.
물리적 하드웨어 보안: AI가 외부에 해를 끼칠 수 있는 자율적인 물리적 하드웨어에 연결될 경우, 유능한 운영 인력이 현장에서 감독을 수행해야 하며, 필요할 때는 장비의 작동을 즉시 중단할 수 있어야 합니다. 그러나 특정 정부 고객에게는 계약 조건과 안전 예방 조치가 충분하다면 관련 규칙을 유연하게 조정할 수 있다고 Anthropic은 밝혔습니다.