클로드 모델의 태도는 언어와 버전에 따라 달라지며 네 가지 기준으로 측정된다
앤트로픽은 인공지능 모델인 클로드의 가치관이 모델 버전과 사용 언어에 따라 달라진다는 연구 결과를 발표했습니다. 회사는 약 31만 건의 실제 대화를 분석하여 네 가지 핵심 축을 도출했습니다. 이 축들은 사용자의 요구 수용 정도, 위험 및 피해 가능성 경계 여부, 긍정적 태도 등을 포함합니다.
댓글
0개
첫 댓글을 남겨보세요.