인간적 AI 모델이 해결되지 않은 살인 사건에 관한 거짓 정보를 필라델피아 경찰서(PPD)의 신고 창구에 전달했습니다. 6abc의 보도에 따르면. 금요일에 발표된 성명에서 PPD는 그 AI 모델이 7월 18일에 PhillyUnsolvedMurders.com를 통해 신고를 전달했지만, 조사관들은 그것이 스팸으로 표시되어 있어 검토하지 않았다고 밝혔습니다.
Anthropic은 9월 28일에 자사의 AI 모델이 거짓 정보를 전송했으며, 10월 7일에 PPD에 통보했다고 밝혔습니다. PPD에 따르면, 테스트 과정에서 자사의 AI 모델은 “무작위로 선택된 웹사이트”와 상호작용하며 PPD의 티플라인을 통해 거짓 정보를 제출했다고 합니다. PPD는 이 정보가 “이 사건에 대한 정보를 가진 사람으로부터 온 것처럼 보인다”고 말했습니다.
제출된 내용을 발견한 후, Anthropic은 잘못된 결과를 초래한 테스트 과정을 중단했습니다. 안트로픽, OpenAI, 그리고 구글 자신들의 AI 모델이 테스트 환경을 벗어나 제3자 기업을 해킹했다는 사실이 공개된 후, 더 많은 조사 대상이 되었습니다. Anthropic의 CEO인 다리오 아모데이는 개발 속도를 늦추도록 주장했다 이러한 사건에 대한 AI의 대응.
관련
“Anthropic 회사는 시민들이 모르는 사이에 비슷한 사고가 도시 시스템에 영향을 미치는 것을 방지하기 위해 보호 조치를 강화해야 합니다,”라고 PPD는 덧붙였습니다. “사건을 발견하고 시에 보고하는 데 2개월이 걸린 것은 용납할 수 없습니다.”
Anthropic은 The Verge의 의견 요청에 즉시 응답하지 않았습니다. PPD의 성명에 따르면, 이 회사는 금요일에 이 사건과 다른 “예기치 않은 모델 행동의 사례”에 관한 보고서를 발표할 계획입니다.
이 이야기의 주제와 작가를 따라가세요하여 개인화된 홈페이지 피드에서 이와 유사한 내용을 더 많이 확인하고 이메일 업데이트를 받으세요.