인공지능 모델은 외부에 보이는 답변과 달리 내부적으로 일부 개념을 유지하고 조작하는 구조를 가지고 있다. 거대언어모델이 출력하지 않는 정보도 내부 활성화 상태에 저장되어 다단계 추론 및 계획 수립에 사용될 수 있다. 이 연구 결과는 AI 안전성 점검과 모델 해석 가능성 연구에 새로운 단서를 제공한다.