AI 답변 이면에 숨겨진 내부 정보와 추론 과정에 대한 연구 결과 발표
인공지능 모델은 외부에 보이는 답변과 달리 내부적으로 일부 개념을 유지하고 조작하는 구조를 가지고 있다. 거대언어모델이 출력하지 않는 정보도 내부 활성화 상태에 저장되어 다단계 추론 및 계획 수립에 사용될 수 있다. 이 연구 결과는 AI 안전성 점검과 모델 해석 가능성 연구에 새로운 단서를 제공한다.
댓글
0개
첫 댓글을 남겨보세요.