대학들, 정확성 우려에 AI 탐지 도구 사용 중단
일부 교육기관은 평가 방식을 전면 개편하고 감시 중심의 접근에서 벗어나려 하고 있다.

아델파이대학교 학생인 오리온 뉴비는 AI를 이용해 에세이를 작성했다는 이유로 학문적 진실성 규정을 위반했다는 잘못된 обвин을 받으면서 자신의 명예를 회복하기 위한 긴 싸움에 직면했다.
올해 1월 뉴욕 법원은 뉴비의 손을 들어줬다. 판결문에 따르면 대학이 사용한 턴잇인 AI 탐지 도구는 ‘AI가 생성했을 확률 100%’라는 결과를 내놓았다. 이에 뉴비는 다른 AI 탐지 도구에서 AI가 생성한 콘텐츠일 가능성이 0%라고 표시된 결과를 증거로 제출했지만, 대학은 부정행위 판정을 유지했다. 법원은 대학이 자체 징계 절차를 따르지 않았으며 뉴비에게 실질적인 항소 기회를 제공하지 않았다고 판단했다.
턴잇인 결과는 해당 도구가 제출물이 AI로 생성됐을 가능성이 매우 높다고 결론 내렸음을 나타내는 확률 점수다. 그러나 이번 판결은 대학들이 사용하는 AI 탐지 도구의 신뢰성에 대한 우려를 부각하고, 평가 시스템 전체에 의문을 제기한다.
학생들의 은밀한 AI 사용이 급증하면서 대학들은 딜레마에 직면했다. 에든버러 네이피어대학교 연구진이 영국 내 7개 대학의 학생 6,600명 이상을 대상으로 실시한 설문조사를 바탕으로 진행한 최근 연구에 따르면, 응답자의 32%가 평가에서 허용되지 않은 AI를 어느 정도 사용했다고 인정했다.
대학들은 2022년 오픈AI의 챗GPT 출시 이후 학문적 진실성을 유지하기 위해 GPT제로, 카피리크스, 턴잇인처럼 AI 탐지 기능을 갖춘 애플리케이션으로 눈을 돌렸다.
이 도구들은 텍스트 구조와 리듬 같은 특징을 분석해 인간이 작성하지 않은 패턴을 식별하지만, 오탐과 편향 측면에서 그 신뢰성에 대한 비판이 거세지고 있다.
AI 교육 보고서 더 보기

AI 연구소들, 6조 달러 규모의 교육시장에 진입하다; 대학들, AI 통합 방식을 두고 어려운 선택에 직면; AI가 교실에서 비판적 사고를 죽이고 있는가?
이후 밴더빌트대, 예일대, 존스홉킨스대, 노스웨스턴대, 캐나다 워털루대, 남아프리카공화국 케이프타운대, 호주 커틴대 등 여러 교육기관은 AI 탐지기 사용을 제한하거나 중단했다.
미국대학협회 디지털 혁신 담당 부회장인 에드워드 왓슨은 가장 큰 우려가 오탐 가능성이라고 지적한다.
그는 “AI 탐지는 기껏해야 학문적 진실성 관련 사안에서 부차적인 역할만 해야 한다”며 “교수진은 AI 탐지를 ‘확정적 증거’나 ‘결정적 증거’로 절대 사용해서는 안 된다”고 말한다.
턴잇인 최고제품책임자인 애니 체치텔리는 자사의 탐지기가 확정적 증거라기보다 ‘출발점’이자 ‘데이터 포인트’라고 주장한다.
추천

그녀는 회사가 “과도한 사용이나 오용”에 대한 우려를 해소하기 위해 대학들과 계속 협력하고 있으며, 지난해에는 최종 제출물 분석에만 의존하는 대신 교사가 학생의 글쓰기 과정이 발전해 가는 모습을 관찰할 수 있도록 하는 제품을 출시했다고 말했다.
업계 전반에서 신뢰성에 대한 우려로 인해 평가 방식이 다른 형태로 전환되고 있다.
그러나 에든버러 네이피어대학교에서 비판적 AI 리터러시를 가르치는 샘 일링워스 교수는 일부 대학이 구두 평가와 학생의 학습 과정 중심으로 평가 방식을 재설계하고 있는 반면, 여전히 많은 대학이 탐지에 의존하고 있다고 지적한다.
벨파스트 퀸스대학교의 교육·학생 담당 부총장인 주디 윌리엄스는 “AI 탐지 도구는 해법이 아닙니다”라고 말한다. “기술은 여전히 발전 중이고, 오탐률이 용납하기 어려울 정도로 높을 수 있으며, AI가 생성한 텍스트는 쉽게 수정할 수 있어 탐지의 신뢰성이 떨어집니다.”
윌리엄스는 “학업의 진실성에 대한 확신을 원한다면 답은 제대로 된 평가 설계입니다”라고 말한다. “중요한 질문은 ‘학생들이 AI를 사용하지 못하게 하려면 어떻게 해야 하는가?’가 아닙니다. ‘우리는 실제로 무엇을 평가하려는가?’입니다.”
퀸스대학교와 다른 대학들에서 이러한 태도 변화가 나타나고 있음에도 정책은 여전히 일관되지 않다. 영국 163개 대학의 정책을 조사한 일링워스의 연구에 따르면, 40%가 넘는 대학에 공개적으로 접근할 수 있는 AI 정책이 없었다.
명확한 접근 방식이 없다는 점은 학생들의 불안을 키우고 있다. 영국 고등교육정책연구소가 2025년 12월 발표한 연구에 따르면, 조사에 참여한 1,054명의 학생 중 42%는 부당하게 부정행위 혐의를 받을 것을 우려해 AI를 사용할 가능성이 낮아졌다고 답했다.
영국 고등교육 독립심사관실은 관련 민원은 여전히 적지만, 대학 내부 절차에서 AI 관련 부정행위 사건이 증가하고 있다고 보고했다.
애덤 워딩엄 비서실장은 “탐지 도구는 검토되는 증거의 일부일 수 있지만, 일반적으로 그 자체만으로 결정적인 근거로 간주해서는 안 됩니다”라고 말했다.
유럽학생연합 집행위원인 우르줄라 리스는 시스템이 학생들에게 AI 도구가 어떻게 결론에 도달했는지 보여주지 않는 “폐쇄적인” 방식으로 운영되는 것을 우려한다. 그녀는 “더 큰 질문은 고등교육이 탐지 기반 접근 방식에 과연 의존해야 하는가입니다”라고 말한다. “학업의 진실성이 단순히 학생들이 잘못된 일을 하는 것을 적발하는 것이 목표인 감시 활동으로 변질되기를 원하지 않습니다.”
서로 다른 나라에서 공부하는 두 학생이 AI를 정확히 같은 방식으로 사용하더라도, 한 명은 처벌받고 다른 한 명은 그렇지 않을 수 있다 우르줄라 리스, 유럽학생연합
탐지 도구가 영어를 모국어로 사용하지 않는 사람들에게 불균형적으로 오탐 결과를 내놓는다는 비판도 있다. 널리 인용되는 2023년 스탠퍼드대 연구가 이를 보여준다.
기술 소송을 전문으로 하는 로펌 Crowell & Moring의 변호사 Joachim Steinberg는 다음과 같이 말한다. “가장 큰 과제는 제도적 지침과 징계 절차를 기술 변화의 속도에 맞추는 것입니다. AI 역량이 계속 빠르게 발전하는 가운데, 대학들은 여전히 명확하고 일관되며 공정한 정책을 마련하기 위해 노력하고 있습니다. 그 결과 많은 학생과 교육자들이 불확실한 환경에서 활동하고 있습니다.”
전 세계적으로 지침은 여전히 파편화돼 있다. Illingworth는 “효과적인 관행에 대한 합의가 없기 때문에 답답한 일이지만, 이는 기관에 훨씬 더 많이 좌우된다”고 지적한다.
Lis는 유럽에서 국가 차원의 지침이 없기 때문에 형평성 문제가 발생한다고 덧붙인다. “서로 다른 국가에서 공부하는 두 학생이 AI를 정확히 같은 방식으로 사용할 수 있지만, 한 명은 처벌받고 다른 한 명은 그렇지 않을 수 있습니다.”
Illingworth의 보고서는 많은 대학 정책이 규정 준수 수단으로 기능한다고 결론짓는다. “이 정책들은 비판적 사고를 약속하지만 감사 추적 기록을 내놓습니다. 지원을 표방하지만 감시를 제공합니다.”
그는 “지속 가능한 해법은 우리가 보고자 하는 사고를 중심으로 평가를 설계하는 것”이라고 말한다.
AI 사용이 늘어남에 따라 대학들이 직면한 과제는 감시를 넘어 무엇이 진정으로 허용 가능한 사용에 해당하는지 규정하는 일이 될 수 있다.
대학 지원을 준비하는 학생들을 돕는 AI 도구 GradPilot의 최고경영자 Nirmal Thacker도 이에 동의한다. “대학들이 평가 방식을 재고하고, 사용 사실 공개를 환영하며, 정책을 투명하게 밝혔으면 합니다.”
법률 혁신을 기념하다