Onderwerpen
Home / Artikelen

AI-detector slaat aan bij je scriptie: hoe betrouwbaar is zo’n uitslag

Je levert je scriptie in, en een week later hoor je dat een AI-detector bij jouw literatuurhoofdstuk op rood staat. Dat is schrikken, zeker als je het zelf hebt geschreven. Studentenblad Folia liet op 9 oktober zien hoe vaak dat nu gebeurt, en het beeld is opvallend. Tijd om uit te zoeken wat zo’n uitslag eigenlijk zegt, waarom hij kan misgaan en wat je doet als je ermee wordt geconfronteerd.
Student werkt op een laptop aan een scriptie in een bibliotheek met boeken en aantekeningen
Foto: Christin Hume via Unsplash
Inhoudsopgave

Wat Folia ontdekte bij vijftig scripties

Folia, het onafhankelijke blad van de Universiteit van Amsterdam, haalde vijftig bachelorscripties uit 2026 van de Faculteit Economie en Bedrijfskunde door de detector Pangram. Alleen de literatuur- en achtergrondhoofdstukken werden getest. In 48 van de 50 scripties werd minstens een deel van de tekst als AI-tekst aangemerkt, gemiddeld ging het om 69 procent. Bij een kwart van de scripties kreeg het literatuurhoofdstuk zelfs een score van honderd procent. Ter controle testte Folia ook tien scripties uit 2021, van voor ChatGPT. Je leest het hele onderzoek in het artikel van Folia.

Belangrijk detail is dat de faculteit studenten juist ruimte geeft om AI te gebruiken, zolang tijdens het scriptieproces vaststaat dat de student de stof beheerst. Een hoge score betekent daar dus niet vanzelf dat iemand iets fout heeft gedaan. Marc Salomon, decaan van de Amsterdam Business School, zegt in Folia dat een detectorscore “geen hard bewijs” is voor oneigenlijk gebruik.

Hoe een AI-detector werkt

Een detector leest geen bedoelingen en heeft geen toegang tot jouw chatgeschiedenis. Hij kijkt naar de tekst zelf en rekent uit hoe voorspelbaar die is. Taalmodellen kiezen vaak het meest waarschijnlijke volgende woord, waardoor hun tekst gelijkmatig en glad wordt. Mensen schrijven meestal grilliger, met onverwachte woorden, lange en korte zinnen door elkaar en kleine eigenaardigheden. Een detector als Pangram is getraind op grote hoeveelheden tekst van mensen en van AI, en geeft per stuk aan welke kant het op lijkt te vallen.

Pangram zelf claimt dat het programma in ongeveer één op de tienduizend gevallen menselijke tekst onterecht als AI aanmerkt. Volgens Folia is onafhankelijk onderzoek iets kritischer en komt het uit op hooguit enkele procenten. Dat klinkt weinig, maar op een hele lichting scripties zijn dat al snel meerdere studenten die ten onrechte verdacht worden.

Waarom de uitslag vaak misgaat bij een scriptie

Juist een literatuurhoofdstuk is lastig terrein voor een detector. Je vat bestaand onderzoek samen in zakelijke, vaste formuleringen. Iedere student schrijft daar varianten van “eerder onderzoek laat zien dat” en “uit de literatuur blijkt”. Die voorspelbare academische stijl lijkt sterk op wat een taalmodel produceert, ook als er geen chatbot aan te pas is gekomen.

Er zijn nog meer redenen waarom een uitslag niet klopt.

  • Schrijven in een tweede taal. Onderzoekers van Stanford lieten in 2023 zien dat detectors teksten van niet-moedertaalsprekers veel vaker als AI aanmerken, omdat die met een kleinere woordenschat werken. Schrijf je je scriptie in het Engels, dan kan dat meespelen.
  • Hulpmiddelen die geen chatbot zijn. Spellingcheckers en herschrijfhulpen in Word of Grammarly maken je tekst gladder. Dat kan de score opdrijven.
  • Korte stukken. Hoe minder tekst, hoe minder houvast een detector heeft. Een losse alinea zegt weinig.
  • Toegestaan gebruik. Mocht je AI gebruiken om te brainstormen of te vertalen, dan kan dat sporen achterlaten zonder dat je een regel overtreedt.

Wij vinden een detectorscore daarom vooral een signaal om het gesprek aan te gaan, en geen oordeel. Dat lijkt ook de lijn bij de faculteit uit het Folia-onderzoek, waar studenten vier voortgangsgesprekken met hun begeleider hebben en hun scriptie mondeling verdedigen. Daar blijkt veel beter of je de stof echt beheerst dan uit een percentage.

Wat je doet als je wordt beschuldigd

Krijg je te horen dat een detector bij jouw werk aanslaat, raak dan niet in paniek en ga ook niet meteen in de verdediging. Neem deze stappen.

  1. Vraag precies wat er is gemeten. Welke tool is gebruikt, welke delen van je tekst zijn gemarkeerd en hoe hoog was de score? Een vaag “de detector sloeg aan” is niet genoeg om op te reageren.
  2. Zoek de AI-regels van jouw opleiding op. Die verschillen per faculteit. Bij de UvA mag het ene programma veel meer dan het andere, zo blijkt uit Folia. Heb je gedaan wat mocht, dan sta je sterker.
  3. Laat je schrijfproces zien. Versiegeschiedenis in Word of Google Docs, je aantekeningen, eerdere conceptversies en de bronnen die je hebt gelezen laten zien hoe je tekst is ontstaan. Bewaar die dingen dus vanaf het begin.
  4. Bied aan om je werk toe te lichten. Wie zijn eigen hoofdstuk kan uitleggen en verdedigen, maakt duidelijk dat hij de stof beheerst. Dat zegt meer dan elke score.
  5. Weet hoe de procedure loopt. Over fraude beslist de examencommissie van je opleiding, niet de docent alleen en zeker niet een programma. Je hebt het recht om gehoord te worden en je kunt in beroep gaan bij het College van Beroep voor de Examens. Een studentendecaan of studentenadviseur kan je daarbij helpen.

Hoe je problemen voorkomt

De beste bescherming is openheid. Gebruik je een chatbot, ook al is het alleen om je structuur te checken of een moeilijke bron te begrijpen, noteer dat dan en vermeld het zoals je opleiding vraagt. Veel instellingen eisen die transparantie al. Schrijf je stukken bij voorkeur in een programma dat je versies bewaart en gooi oude concepten niet weg.

Het debat over detectors is nog lang niet klaar. Er wordt ook gewerkt aan andere manieren om AI-tekst te herkennen, zoals verborgen watermerken. Hoe dat in Europa gaat werken, lees je in ons stuk over het onzichtbare watermerk op ChatGPT-tekst. Tot die tijd geldt dat een rode uitslag een vraag is, geen vonnis. Zorg dat je die vraag rustig en met bewijs kunt beantwoorden.

Redactie Zendis

Lees meer over onze redactie en werkwijze.