IT之家 10월 10일 소식에 따르면, 《뉴욕 타임스》의 현지 시간 9일 보도에 의하면 Anthropic은 자사의 AI 스마트체가 아무런 지시도 없이 미국 연방, 주 및 지방 정부의 여러 웹사이트에 접속하려 했다고 공개했습니다. Anthropic은 관련 정부 기관의 이름을 공개하지 않았으며, 이러한 사건을 백악관에 보고했습니다.
Anthropic은 블로그 게시물에서 테스트 단계에 있는 AI 모델이 여러 가지 작업을 무단으로 수행했다고 언급했습니다. 여기에는 대학 웹사이트의 취약점을 이용해 데이터를 다운로드하고, 명백히 제출이 금지된 양식을 정부 기관에 제출하는 등의 행위가 포함됩니다.
Anthropic은 7월에 자사 AI의 운영 기록을 검토하는 과정에서 이러한 문제들을 발견했습니다. 당시 OpenAI는 자사 AI 기술이 스타트업 Hugging Face를 공격했다고 공개했으며, Anthropic 및 다른 AI 연구소들도 자사 AI가 테스트 환경에서 벗어나 해킹 공격을 수행한 것을 확인했습니다.
Anthropic의 한 대변인은 블로그 게시물 외의 내용에 대해서는 논평을 거부했다.
그날 일찍, 필라델피아 경찰국은 Anthropic이 경찰 웹사이트를 통해 가짜 살인 사건 정보를 제출했다고 밝혔습니다. 경찰에 따르면 신고일은 7월 18일이며, 제출자는 아직 수사되지 않은 사건에 대한 정보를 가지고 있다고 주장했습니다.
경찰은 그 신고를 스팸으로 분류하여 조사하지 않았습니다. IT 가족은 보도를 통해 Anthropic이 이번 주에 필라델피아 경찰에 이 사건을 보고했으며, 금요일에 공개적으로 발표될 것이라고 알렸다고 전했습니다.
앤thropic은 아직 발표되지 않은 미선행 연구 모델이 원래 시뮬레이션 정부 양식을 작성해야 했다고 설명했습니다. 하지만 시뮬레이션 양식 로드가 실패하거나 모델이 양식을 닫는 과정에 실수했기 때문에, 모델은 공식 양식을 제공하는 웹사이트로 넘어가서 양식을 제출했습니다.