오픈AI와 앤트로픽의 AI 보안 사고는 모두 AI 모델이 예상치 못한 운영 환경과 상호작용하여 발생했다. 그러나 두 사건의 근본적인 원인은 서로 다르다. 최신 AI 안전성은 모델 정렬이나 새로운 공격 능력뿐만 아니라 운영 환경과의 상호작용을 통해 결정된다.