58.000 studenten moeten herexamen doen na AI-toezicht dat niet werkte

58.000 studenten moeten herexamen doen na AI-toezicht dat niet werkte

TL;DR

  • Wat: De grootste universiteit van Mexico (UNAM) liet voor het eerst toelatingsexamens online afnemen met AI-toezicht — met massale fraude als gevolg.
  • Waarom relevant: elke organisatie die examens, certificeringen of selectieprocedures digitaliseert, loopt hetzelfde risico.
  • Wat je ermee kunt: vraag jezelf af of jouw digitale toets- of selectieprocessen bestand zijn tegen AI-hulpmiddelen aan de andere kant van het scherm.

Ik viel deze week over een bericht van Ars Technica: de Mexicaanse UNAM — een universiteit met meer dan 150.000 aanmeldingen per jaar — moet zo'n 58.000 kandidaten opnieuw laten examineren, dit keer fysiek en op papier. De reden: het AI-bewakingssysteem dat fraude moest voorkomen, bleek massaal omzeild te worden. Wat mij hier fascineert, is niet alleen de schaal, maar hoe snel de zwakke plekken zichtbaar werden zodra je een bestaand proces digitaliseert.

Wat er precies gebeurd is

De UNAM (Universidad Nacional Autónoma de México) is de oudste en meest prestigieuze universiteit van Mexico. In mei en juni 2026 koos de universiteit er voor het eerst voor om de toelatingsexamens volledig online af te nemen, onder meer om de toegankelijkheid te verbeteren. Het Mexicaanse techbedrijf Territorium Life leverde de software: een AI-systeem met camera- en microfoonbewaking, gedragsanalyse door experts, en blokkering van extra browsertabbladen.

Het liep anders dan gepland. Toen de resultaten in juli binnenkwamen, viel op dat het percentage kandidaten met hoge scores drie keer zo hoog lag als in voorgaande jaren. Bij geneeskunde scoorde 29,3% van de kandidaten 100 of meer juiste antwoorden — in 2025 was dat nog 9%. Bij rechten steeg dat percentage van 3,7% naar 18,9%.

Psycholoog Eduardo Backhoff vatte het kernachtig samen: "Óf de examens waren makkelijker, óf de studenten waren slimmer, óf er is gefraudeerd. De eerste twee mogelijkheden zijn hoogst onwaarschijnlijk."

Hoe de fraude werkte

Wat mij opvalt, is hoe laagdrempelig de trucs waren. Geen geavanceerde hacks, maar simpele workarounds:

  • Tweede apparaat buiten beeld: kandidaten zetten een telefoon of laptop net buiten het bereik van de webcam en lieten ChatGPT of andere AI-tools de vragen beantwoorden.
  • TikTok-handleidingen: vóór het examen circuleerden er video's die stap voor stap uitlegden hoe je het toezicht kon omzeilen.
  • Hulp van buitenaf: iemand hield een scherm met antwoorden omhoog, buiten het camerakader.
  • Gelekte vragen: de examens bleven zeventien dagen open, waardoor vragen konden worden doorgespeeld of verkocht.

Het AI-systeem van Territorium Life ving ongeveer 2% van de fraudegevallen op — zo'n 3.000 examens werden ongeldig verklaard. Maar AI-onderzoeker Raul Rojas schatte op basis van statistische analyse dat bijna de helft van alle kandidaten hulp had gehad. Het bedrijf zelf stelt dat het platform "functioneerde zoals gepland". Dat is op zich een veelzeggende uitspraak: het systeem deed technisch wat het moest doen, maar de aanname dat webcam plus AI voldoende is om fraude te voorkomen, bleek niet te kloppen.

De gevolgen: 58.000 herexamens op papier

Rector Leonardo Lomelí Vanegas schortte de inschrijvingen op en stelde een commissie van zestien experts in — specialisten in onderwijs, AI en recht. De universiteit kondigde aan dat alle kandidaten die een voldoende haalden, dit jaar én in de afgelopen vijf jaar, een fysiek herexamen moeten afleggen. Dat gaat om circa 58.000 mensen.

Het nieuwe examen wordt met pen en papier afgenomen, op locatie. Het semester zou op 10 augustus moeten beginnen, maar dat staat onder druk. De Mexicaanse president Claudia Sheinbaum — zelf oud-student natuurkunde aan de UNAM — suggereerde dat het openbaar ministerie erbij betrokken zou moeten worden. Er zijn strafrechtelijke klachten ingediend tegen aanbieders van fraudediensten.

Geen Mexicaans probleem — het speelt ook dichterbij

Ik zou het makkelijk vinden om dit af te doen als een probleem van ver weg. Maar kijk even naar wat er in België en Nederland gebeurt.

In Vlaanderen werden vorig jaar vijf kandidaten betrapt op het gebruik van ChatGPT tijdens het toelatingsexamen geneeskunde — ze openden de chatbot in een ander browsertabblad. Het gevolg: dit jaar legden 7.000 studenten het examen af met pen en papier, op één centrale locatie in Brussel. Elektronische apparaten, inclusief smartwatches, zijn verboden.

In Nederland ziet het CBR een sterke toename van fraude bij theorie-examens: kleine camera's, oortjes en AI-tools die antwoorden influisteren. Het aantal betrapte gevallen is volgens het CBR tussen 2022 en 2025 bijna verdubbeld — en dat is vermoedelijk het topje van de ijsberg.

Ondertussen classificeert de Europese AI-verordening proctoring-systemen als hoog-risico AI. Dat betekent extra verplichtingen voor organisaties die ze inzetten: transparantie, menselijk toezicht, en documentatie van de risico's.

Wat dit betekent als je zelf digitaal toetst of selecteert

Je hoeft geen universiteit te zijn om hier iets van te leren. Stel dat je als ondernemer certificeringsexamens aanbiedt, sollicitanten online laat testen, of e-learning met toetsing inzet — dan is de les uit Mexico tamelijk helder.

Het probleem zit niet in de technologie op zich. Het zit in de aanname dat digitaal toezicht even betrouwbaar is als fysiek toezicht. Een webcam die het gezicht van een kandidaat filmt, controleert niet wat er op een tweede scherm staat. AI-gedragsanalyse vangt verdachte oogbewegingen op, maar niet een telefoon die net buiten beeld ligt.

Drie vragen om jezelf te stellen

  1. Wat test je eigenlijk? Als het antwoord is "kennis reproduceren", dan is elke online toets kwetsbaar zodra kandidaten toegang hebben tot AI. Misschien is de vraag niet hoe je beter bewaakt, maar hoe je anders toetst.
  2. Wat zijn de gevolgen van fraude? Bij een laagdrempelige interne quiz is het risico beperkt. Bij een selectie-examen dat iemands carrière bepaalt, is de schade bij fraude groot — voor de organisatie én voor eerlijke kandidaten.
  3. Heb je een plan B? UNAM had er geen. Het semester staat nu op losse schroeven. Een herexamen voor 58.000 mensen organiseren kost tijd, geld en geloofwaardigheid.

Waar het op neerkomt

Ik vind het eerlijk gezegd een leerzaam voorbeeld — niet omdat de UNAM iets doms deed, maar omdat ze iets deden wat heel logisch klonk. Online examens zijn goedkoper, toegankelijker en schaalbaar. Maar de veiligheidsaannames waren gebaseerd op een wereld zonder ChatGPT en TikTok-handleidingen.

Voor mij is dit vooral een signaal dat digitalisering van toetsing niet alleen een technische stap is, maar een fundamentele herontwerp-vraag. Niet "hoe bewaken we het oude examen via een scherm?" maar "wat voor toets werkt als je ervan uitgaat dat kandidaten AI tot hun beschikking hebben?" Die vraag is niet alleen relevant voor universiteiten, maar voor elke organisatie die op basis van toetsresultaten beslissingen neemt.

80% van de AI-projecten haalt productie nooit.

Ik bouw de 20% — van prototype naar draaiend systeem, binnen weken.