이 글은 arXiv에 게시된 AI 작문을 측정하는 방법과 그 측정의 한계에 대해 다루고 있습니다. 연구자들은 AI가 작성한 텍스트를 평가하기 위한 기준을 제시하고 측정 과정에서 발생하는 문제점들을 분석합니다. 이는 AI 생성 콘텐츠의 품질을 객관적으로 평가하는 데 중요한 시사점을 제공합니다.