UNAM AI 감독 실패? 5만 8천 명 재시험과 온라인 입학시험 부정행위 논란 분석

이 글의 정보는 2026년 8월을 기준으로 합니다. UNAM의 기술위원회는 현재도 사건의 원인과 책임 소재를 조사하고 있으며, 검증 시험의 구체적인 시행 방식도 계속 조정될 수 있습니다.

2026년 멕시코 국립자치대학교 UNAM은 처음으로 학부 입학시험을 전면 온라인으로 전환하고, AI 감독, 보안 브라우저와 사람의 검토 절차를 도입했습니다. 지방에 거주하는 수험생이 한 번의 시험을 위해 장거리를 이동하지 않아도 되게 하려는 목적이었습니다. 그러나 시험 결과가 발표된 뒤 100문제 이상을 맞힌 수험생의 비율이 지난 5년간의 3.5%에서 16.3%로 상승했습니다. 학교 측은 결국 약 5만 8천 명에게 대면 검증 시험을 치르게 해 입학 자격을 다시 확인하기로 결정했습니다.

이번 논란을 단순히 「AI 감독이 부정행위를 적발하지 못했다」는 문제로 축소해서는 안 됩니다. 시스템은 시험 중 실제로 경고를 생성했고, UNAM도 약 2%에 해당하는 수험생의 입학 절차를 취소했습니다. 그러나 감독 기록과 전체 성적 분포 사이에는 무시하기 어려운 차이가 나타났습니다. 두 번째 기기, 카메라 사각지대, 외부 조력과 대리시험 서비스 판매 의혹은 카메라 한 대를 추가한다고 해결되는 문제가 아닙니다. AI 감독, 온라인 시험이나 원격 평가 도입을 검토하는 학교와 기업에 UNAM 사건은 현실적인 제도 압박 시험의 사례를 제공합니다.

UNAM 온라인 입학시험에서 무슨 일이 있었을까? 첫 원격 시험부터 5만 8천 명 재시험까지

UNAM은 원래 대부분의 학부 입학시험 수험생에게 지정 시험장에 출석하도록 요구했습니다. 2026년 처음으로 시험을 전면 온라인으로 전환했으며, 시험은 5월 23일부터 6월 10일까지 진행되었습니다. 수험생은 기준을 충족하는 컴퓨터, 카메라, 마이크와 보안 브라우저를 준비하고 지정된 시간에 시스템에 접속해 문제를 풀어야 했습니다.

총 191,306명이 지원했고 실제 시험 응시자는 158,712명이었습니다. 학교 측은 온라인 방식이 지방과 해외 수험생의 교통비, 숙박비와 이동 부담을 줄이고 실제 응시율도 높일 수 있다고 설명했습니다. UNAM은 시험 초기 첫 번째 주말에 55,840명이 응시했으며 플랫폼이 안정적으로 운영되었고, 498명은 규정 위반으로 시험이 중단되거나 시스템에서 퇴장 조치되었다고 발표했습니다.

7월 16일 UNAM은 성적 발표 하루 전, 약 2%의 수험생이 모집 요강과 학교 규정을 위반해 입학 절차가 취소되었다고 밝혔습니다. 당시 학교 측은 여전히 기존 일정에 따라 합격자 명단을 발표하고 후속 등록 절차를 진행할 예정이었습니다.

UNAM 입학시험에서 고득점자 비율은 왜 3.5%에서 16.3%로 상승했을까?

사건이 본격적으로 확대된 원인은 일부 시험이 시스템에 의해 중단되었다는 사실이 아니라, 7월 17일 성적 발표 후 나타난 전체 점수 분포였습니다.

UNAM 학부 입학시험은 총 120문제로 구성됩니다. 2021년부터 2025년까지 100문제 이상을 맞힌 수험생은 평균 약 3.5%였지만, 2026년에는 16.3%로 상승했습니다. 비정상적으로 높은 점수는 의학, 법학 등 경쟁이 치열한 학과에 집중되었고, 일부 교수, 수험생과 통계 연구자들은 시험 결과가 수험생의 실제 실력을 여전히 반영하는지 의문을 제기하기 시작했습니다.

베를린 자유대학교의 인공지능 연구자 Raúl Rojas는 2021년부터 2026년까지의 성적 분포를 비교한 뒤, 2026년 수험생 성적을 두 개의 통계 집단으로 구분했습니다. 한 집단은 여전히 지난 5년간의 분포와 비슷했지만, 다른 집단은 고득점 구간에 대량으로 집중되어 있었습니다. 그는 이러한 편차를 시험 문제가 갑자기 쉬워졌거나 전체 수험생의 실력이 향상되었다는 이유만으로 설명하기는 어렵고, 많은 수험생이 외부의 도움을 받았다는 가설과 더 일치한다고 판단했습니다.

그러나 통계적 이상만으로 특정 수험생의 부정행위를 직접 증명할 수는 없습니다. 전체 분포가 과거와 지나치게 다르기 때문에 응시 기록, 플랫폼 자료와 문제 보안을 추가로 조사해야 한다는 점만 보여 줍니다. UNAM이 모든 고득점자의 성적을 바로 취소하지 않고 대면 검증 시험을 마련한 이유도 여기에 있습니다.

Territorium Life는 어떻게 시험을 감독했을까? AI 경고·보안 브라우저와 사람의 재검토

UNAM이 사용한 온라인 시험 플랫폼은 Territorium Life에서 제공했습니다. 시험 시스템에는 신원 확인, 얼굴과 음성 인식, 카메라 및 마이크 기록, 화면 활동 감시, 보안 브라우저와 이상 행동 경고 등의 기능이 포함되었습니다. 보안 장치는 동일 계정으로 여러 기기에서 동시에 접속하는 것을 차단하고, 다른 애플리케이션으로 전환하거나 복사·붙여넣기, 화면 캡처와 외부 모니터를 사용하는 행위도 제한하도록 설계되었습니다.

AI가 수험생의 부정행위 여부를 스스로 결정한 것은 아닙니다. UNAM에 따르면 시스템은 의심스러운 행동을 감지해 경고를 생성하는 역할만 담당했고, 최종적으로는 학교 직원이 영상, 음성과 조작 기록을 확인한 뒤 시험을 중단하거나 취소할지를 결정했습니다.

Territorium Life는 논란이 발생한 뒤 플랫폼이 회사가 담당한 기술 범위 안에서 예상대로 작동했으며, 한 차례 시험에서 동시에 1만 명이 넘는 수험생을 처리한 적도 있다고 밝혔습니다. 회사는 고위험 시험의 완전성을 유지하려면 기술적 감독만으로는 부족하며, 문제은행 보안, 시험 설계와 학교 측의 관리도 함께 필요하다고 주장했습니다.

이 설명으로 논란이 해소되지는 않았습니다. 플랫폼은 수험생이 같은 컴퓨터에서 다른 웹페이지로 이동하지 못하게 할 수 있지만, 방 반대편에 휴대전화, 태블릿이나 다른 컴퓨터가 놓여 있는지는 확인하기 어렵습니다. 시스템이 기록할 수 있는 것은 화면 안에서 발생한 일이며, 카메라 밖의 공간에는 여전히 사각지대가 존재합니다.

AI 감독은 왜 부정행위를 막지 못했을까? 원격 시험의 구조적 취약점

AI 감독은 시험이 절대적으로 공정하다는 사실을 증명하는 폐쇄형 시험장이라기보다, 이상 행동을 기록하고 위험을 선별하는 도구에 가깝습니다. UNAM 사건은 플랫폼이 정상적으로 영상을 녹화하고 브라우저를 차단하며 경고를 생성하더라도, 전체 시험이 시스템이 볼 수 없는 외부 조건의 영향을 받을 수 있다는 점을 보여 줍니다.

보안 브라우저는 해당 컴퓨터를 차단할 수 있는데, 왜 다른 기기는 통제하지 못할까?

보안 브라우저는 시험에 사용하는 컴퓨터를 제한할 수 있습니다. 검색엔진을 열거나 창을 전환하고, 문제를 복사하거나 특정 단축키를 사용하는 행위를 금지할 수 있습니다. 그러나 이러한 제한은 일반적으로 소프트웨어가 설치된 기기에만 적용됩니다. 수험생이 카메라 밖에 휴대전화, 태블릿이나 두 번째 컴퓨터를 두더라도 주요 응시 기기는 정상적인 상태를 유지할 수 있습니다. 화면 전환이 발생하지 않고 보안 브라우저도 종료되지 않으면 시스템이 반드시 경고를 생성하는 것은 아닙니다. 원격 감독 관련 연구에서도 이러한 도구가 즉흥적이고 눈에 띄는 규정 위반을 억제하는 효과는 있을 수 있지만, 두 번째 기기를 사용하거나 자료를 카메라 밖에 숨기고 다른 사람이 원격으로 도움을 제공하는 등 사전에 계획된 부정행위까지 항상 발견할 수 있는 것은 아니라고 지적합니다.

AI 경고는 이상 행동만 지적할 수 있으며, 부정행위를 스스로 판정할 수 없다

수험생이 고개를 숙이거나 시선을 돌리고, 배경에서 소리가 나거나 얼굴이 잠시 카메라 밖으로 벗어나면 경고가 발생할 수 있습니다. 그러나 이러한 행동은 인터넷 연결 문제, 가족의 이동, 장비 문제나 신체 상태 때문에 발생할 수도 있습니다. UNAM은 시험 기간에 주변 소음만으로 시험이 바로 취소되지는 않는다고 별도로 설명했습니다. AI가 생성한 경고는 사람의 검토를 거쳐야 하며, 학교 직원은 앞뒤 영상과 다른 기록을 함께 확인해야 합니다. 단일 신호만으로 규정 위반을 판단할 수는 없습니다. 이러한 설계는 오판을 줄일 수 있지만 검토 부담도 늘립니다. 응시자가 15만 명을 넘고 수험생마다 장시간의 영상, 음성과 조작 기록이 남는다면 검토팀이 모든 기록을 처음부터 끝까지 확인하기는 어렵습니다. 실제 절차에서는 일반적으로 시스템이 위험도가 높은 구간을 먼저 선별하고, 표시된 사례를 중심으로 검토할 수밖에 없습니다.

표시되지 않았다고 해서 아무 문제가 없었다는 뜻은 아닙니다. 표시되었다고 해서 반드시 부정행위를 했다는 뜻도 아닙니다.

문제 유출과 외부 지원은 반드시 영상 증거를 남기는 것이 아니다

UNAM은 시험 기간에 개인이나 기업이 수험생과 가족에게 규정 위반이 의심되는 응시 서비스를 판매한 사실을 확인했고, 7월 3일 관련 행위에 대한 수사를 요청하는 형사 고발을 제출했습니다. 현재로서는 모든 비정상적인 고득점을 하나의 수법으로 설명할 수 없으며, 모든 문제 세트가 유출되었는지도 확인되지 않았습니다. 그러나 시험이 여러 날짜와 시간대에 걸쳐 진행된다면 문제 반복 비율, 시험지 버전 수와 문제은행 관리 방식이 위험도에 직접적인 영향을 줍니다. 카메라 감독은 수험생이 시험을 치르는 순간의 행동을 다룹니다. 문제가 사전에 유통되었는지, 답안이 시험 회차 사이에 전달되었는지, 제3자가 원격으로 지원했는지는 별도의 보안 문제입니다. 두 문제를 같은 감독 소프트웨어만으로 해결할 수는 없습니다.

성적 분포의 이상은 왜 합격자 발표 후에야 논란을 일으켰을까?

UNAM은 시험이 진행되는 동안 플랫폼 안정성, 규정 위반 경고와 개별 수험생의 행동 기록에 주로 집중했습니다. 그러나 전체적인 문제는 성적이 발표된 뒤 누군가 2026년과 이전 5년간의 점수 분포를 함께 비교하면서 본격적으로 드러났습니다. 이는 학교 측이 시험 중 행동 감시 체계는 구축했지만, 결과 발표 전 통계 검증을 통해 비정상적인 결과를 제때 차단하지 못했다는 뜻입니다. 대규모 시험에서 수험생을 감독하는 것과 성적의 합리성을 확인하는 것은 서로 다른 문제입니다. 전자는 개인의 행동을 처리하고, 후자는 전체 분포가 갑자기 달라졌는지를 확인합니다. 둘 중 하나만 실시하면 다른 영역의 문제를 놓칠 수 있습니다.

2% 취소에서 5만 8천 명 재검증까지: UNAM의 결정은 왜 반발을 일으켰을까?

성적 발표 후 UNAM은 먼저 기술위원회를 구성해 온라인 시험 절차, 플랫폼 자료와 전체 결과를 조사했습니다. 7월 24일 학교 측은 위원회의 권고를 기다리기 위해 7월 27일부터 시작될 예정이었던 서류 제출과 신입생 등록 절차를 중단했습니다. 기술위원회는 최종적으로 대면 검증 시험을 시행할 것을 권고했습니다. 응시 대상은 두 부류였습니다. 첫 번째는 2026년에 이미 합격 통지를 받은 수험생이고, 두 번째는 2026년 최초 시험 성적이 해당 학과, 캠퍼스와 수업 방식의 2021년부터 2026년 사이 최저 합격 기준에 도달한 수험생입니다.

이 기준은 지난 5년간 시험을 치른 수험생에게 다시 시험을 보도록 요구하는 것이 아닙니다. 과거 5년간의 최저 합격 점수는 2026년 수험생 가운데 검증 시험 대상자를 정하는 기준으로만 사용됩니다. 약 5만 8천 명이 검증 시험에 초대되어, 원래 시험으로 배정될 예정이었던 약 2만 2천 개의 입학 정원을 두고 경쟁할 것으로 추산됩니다. 검증 시험은 대면 시험장과 사람의 감독 아래 진행되며, 충분한 수의 서로 다른 시험지 버전도 준비됩니다. 최종 합격자는 첫 번째 온라인 시험 결과를 그대로 적용하지 않고 검증 시험 성적에 따라 다시 배정됩니다. UNAM은 지방 수험생이 다시 이동해야 하는 부담을 줄이기 위해 멕시코시티 외 지역에도 시험장을 추가하겠다고 발표했습니다. 2026학년도 신입생의 수업 시작일은 8월 31일로 연기될 예정이며, 기존 재학생은 8월 17일에 수업을 재개할 예정입니다.

이 조치는 양쪽 모두의 불만을 불러왔습니다. 이미 합격 통지를 받은 수험생은 학교 측이 정직하게 응시한 사람과 부정행위가 의심되는 사람을 구분하지 않은 채, 기준을 충족한 모든 수험생에게 제도 실패의 비용을 부담시켰다고 주장합니다. 원래 불합격했던 수험생은 비정상적인 점수가 합격 기준을 높여 실제로 입학할 수 있었던 사람을 밀어냈을 수 있다고 주장합니다. UNAM 전 사무총장 Patricia Dávila는 8월 1일 사임했고, 이후 Javier de la Fuente가 후임으로 취임했습니다. 사임 시기와 시험 논란이 겹치면서 언론은 이를 사건 이후의 중요한 인사 변화로 보았습니다. 그러나 학교 측은 이번 논란이 그녀의 사임을 결정한 유일한 원인이었는지는 공개적으로 밝히지 않았습니다.

AI 감독을 어떻게 사용해야 안전할까? 문제은행·통계 검토와 이의 신청 절차

UNAM 사건이 모든 온라인 시험을 신뢰할 수 없다고 증명한 것은 아니며, AI 감독이 완전히 쓸모없다는 뜻도 아닙니다. 문제는 고위험 시험에서 AI 감독을 유일한 방어선으로 사용하면, 시스템이 확인할 수 없는 부정행위가 발생했을 때 시험 전체 결과의 신뢰성이 무너질 수 있다는 점입니다.

AI 감독을 유일한 방어선으로 사용하지 않기

카메라, 마이크와 보안 브라우저는 눈에 보이는 행동을 기록하고 일부 즉흥적인 규정 위반을 막는 데 적합합니다. 그러나 문제은행 보안, 시험지 버전 관리와 시험 후 통계 분석을 대신할 수는 없습니다. 대규모 시험에서는 문제를 무작위로 추출하고, 문제 순서를 조정하며, 여러 개의 동등한 난이도 시험지를 만들고, 각 시험 회차 사이의 문제 반복 비율을 관리할 수 있습니다. 시험이 며칠 동안 진행된다면 문제가 소셜 미디어나 유료 단체 대화방에서 유통될 가능성도 평가해야 합니다. 원격 감독 연구에서는 감독 도구를 여러 방어 단계 가운데 하나로 사용하는 것이 적절하다는 견해가 일반적입니다. 계획된 외부 지원이나 두 번째 기기를 이용한 부정행위를 소프트웨어만으로 완전히 막기는 어렵습니다.

성적 발표 전에 과거 분포부터 검사하기

합격자 발표 전에 연도별 평균 점수, 고득점자 비율, 문항별 정답률과 학과별 성적 분포를 비교해야 합니다. 특정 연도에 고득점자가 갑자기 대량으로 나타났다면 소셜 미디어에서 문제가 제기된 뒤에야 검사를 시작해서는 안 됩니다. 통계 검토도 전체 평균만 확인해서는 안 됩니다. 고득점이 특정 시험 회차, 시험지 버전, 응시 지역이나 기기 환경에 집중되었는지도 각각 다른 단서를 제공할 수 있습니다. 시험 주관 기관은 결과 발표를 중단할 조건도 사전에 정할 수 있습니다. 예를 들어 고득점자 비율이 과거 범위를 일정 수준 이상 벗어나거나, 일부 문제에서 비정상적으로 동일한 답안이 나타나면 먼저 사람의 검토를 거친 뒤 결과 발표 여부를 결정할 수 있습니다.

전체 기록을 보존하고, 이해할 수 있는 이의 신청 절차도 제공하기

AI 감독에서 생성된 경고가 내부 코드로만 남아서는 안 됩니다. 수험생의 자격이 취소되었다면 어느 구간의 영상과 어떤 규정이 문제가 되었는지, 사람의 재검토를 요청할 수 있는지 알아야 합니다. UNAM은 논란이 발생한 뒤 일부 수험생이 시험 취소의 근거를 확인할 수 있게 했으며, 불합격자가 제출한 성적 재검토 요청도 처리했습니다. 이러한 절차가 시험 전에 규정으로 정리되어 있다면 수험생은 언제 이의를 신청할 수 있는지, 누가 검토하는지, 결과를 언제 받을 수 있는지를 더 명확하게 알 수 있습니다. 이의 신청 절차는 AI 오판으로 인한 피해도 줄일 수 있습니다. 이상 경고는 조사의 출발점일 뿐, 부정행위의 증거와 동일하지 않습니다.

시험 전에 제도가 실패했을 때의 처리 방식부터 결정하기

고위험 시험은 성적에 문제가 나타난 뒤에야 재시험 여부를 논의해서는 안 됩니다. 주관 기관은 문제의 정도에 따른 처리 방식을 미리 정의할 수 있습니다. 개별 수험생 기록에 명확한 증거가 있다면 해당 사례만 취소하고, 특정 시험 회차의 문제 보안이 훼손되었다면 해당 회차만 다시 시험을 치르게 할 수 있습니다. 전체 성적 분포의 신뢰성이 무너졌을 때는 더 넓은 범위의 검증 시험을 시행할 수 있습니다. 재시험 대상 범위, 교통비 지원, 특별한 지원이 필요한 수험생을 위한 조치, 이의 신청 기한과 새 성적의 계산 방식도 시험 전에 비상 계획에 포함해야 합니다. 제도에 문제가 발생하더라도 「모두 인정하기」와 「모두 다시 시험 보기」라는 두 가지 선택지만 남지 않게 하기 위해서입니다.

UNAM 사건은 AI 감독이 전혀 쓸모없다는 사실을 증명한 사례가 아닙니다. 시스템은 실제로 실시간 경고를 생성하고 시험 기록을 보존했으며, 위반으로 판단된 일부 수험생의 응시 자격도 취소했습니다. 문제는 이러한 기능만으로 전체 성적의 신뢰성을 입증하기에는 부족했다는 점입니다.

두 번째 기기, 외부 지원, 문제 유통과 비정상적인 점수 분포는 카메라를 한 대 더 설치한다고 해결할 수 있는 문제가 아닙니다. 고위험 시험에서 원격 방식을 유지하려면 감독 소프트웨어, 문제은행 관리, 통계 검토, 사람의 재검토와 이의 신청 제도를 하나의 절차 안에 포함해야 합니다. 어느 한 단계라도 준비되지 않으면 재시험과 일정 지연의 비용은 결국 수험생이 부담하게 됩니다.

자주 묻는 질문 FAQ

UNAM의 2026년 입학시험에서 무슨 일이 있었나요?

UNAM은 처음으로 학부 입학시험을 전면 온라인으로 진행했지만, 성적 발표 후 비정상적인 고득점 분포가 나타났습니다. 학교 측은 기술위원회를 구성해 조사한 뒤, 지정된 성적 조건에 도달한 약 5만 8천 명의 2026년 수험생에게 대면 검증 시험을 치르게 하기로 결정했습니다.

UNAM은 왜 온라인 입학시험에서 부정행위가 있었을 가능성을 의심했나요?

2021년부터 2025년까지 100문제 이상을 맞힌 수험생은 평균 약 3.5%였지만, 2026년에는 16.3%로 상승했습니다. 통계 분석에서는 고득점 구간에 과거와 분명히 다른 집단이 나타났지만, 통계적 이상만으로 개별 수험생의 부정행위를 증명할 수는 없습니다.

UNAM의 AI 감독 시스템이 수험생의 부정행위를 스스로 판정했나요?

아닙니다. AI는 주로 화면, 음성과 컴퓨터 활동을 기록하고 의심스러운 행동에 대한 경고를 생성했습니다. 최종적으로는 UNAM 직원이 증거를 검토하고 결정을 내렸습니다.

입학시험에 응시한 15만 명 이상이 모두 재시험을 치러야 하나요?

아닙니다. 검증 시험 대상자는 2026년 합격 통지를 받은 사람과, 2026년 최초 성적이 해당 학과, 캠퍼스와 수업 방식의 2021년부터 2026년 사이 최저 합격 기준에 도달한 사람입니다. 대상자는 약 5만 8천 명으로 추산됩니다.

AI 감독은 두 번째 기기나 외부의 도움을 완전히 차단할 수 있나요?

불가능합니다. 보안 브라우저는 주요 응시 컴퓨터를 제한하고, 카메라와 마이크는 주변 환경의 일부를 기록할 수 있습니다. 그러나 다른 휴대전화, 카메라 사각지대와 사전에 준비된 외부 지원은 감독을 피할 가능성이 있습니다. 기술 연구에서도 여러 원격 감독 도구의 부정행위 방지 장치가 우회될 수 있다는 결과가 나왔으므로, 이를 유일한 시험 보안 장치로 사용해서는 안 됩니다.

SUPPORT FENGNIII

喜歡這篇文章嗎?

如果這篇內容對你有幫助,可以透過小額贊助支持本站持續整理更多日文、韓文、旅行與數位工具內容。

小額支持本站

付款將由藍新金流安全處理