마이크로소프트 CEO 사티아 나델라는 AI 안전성을 어떻게 개선할 수 있는지에 대한 긴급한 의견을 제시한 최신 기술 임원입니다.
X에서의 토요일 아침 포스트에서, 나델라는 인공지능의 “신뢰 구조를 평가하기 위해 한 발 물러서는” 때가 왔다고 썼습니다.
“우리는 슈퍼 인텔리전스를 중첩된 검은 상자 집합으로 취급하여 그 제안, 답변, 행동을 단순히 받아들이거나 거부할 수 없습니다,”라고 나델라는 AI에 대한 트럼프 행정부가 선호하는 용어를 사용하여 썼습니다.
나델라가 설명한 바와 같이, 이 접근 방식은 “모델과 그 작동을 조절하는 시스템을 분리하는 것”이며, “통제 및 보호 장치도 외부화하는 것”을 의미합니다. 그는 또한 “모든 의미 있는 모델 관련 조치”는 “변조가 불가능한 인간이 읽을 수 있는 증거”로 문서화되어야 하며, “승인된 사람만이 작업 중에 모델을 일시 중단하거나 종료할 수 있는” 시스템이 필요하다고 강조했습니다.
“모델이 침해당했다고 가정하고 처음부터 그것을 막아야 합니다,”라고 그는 말했습니다. “긴급 브레이크처럼 생각하세요.”
나델라의 발언은 주요 AI 기업들이 점점 더 많은 사례에서 모델의 통제력을 잃는 것처럼 보인다를 인식하고, Anthropic CEO Dario Amodei가 더 신중한 AI 개발을 위한 계획을 발표한 후에 나온 것입니다.
