AI-detectors kunnen nuttige aanwijzingen geven, maar ze zijn niet volledig betrouwbaar. Ze kunnen menselijke tekst ten onrechte als AI markeren, een zogenoemde false positive, en ze kunnen AI-tekst missen. Een percentage moet je daarom nooit los van de context interpreteren.
Turnitin maakt die onzekerheid zelf zichtbaar. Wanneer zijn AI-detectie minder dan 20% van een geschikte tekst als waarschijnlijk AI-geschreven beoordeelt, toont Turnitin geen exact percentage maar een sterretje. Volgens Turnitin zijn resultaten in het bereik van 1 tot 19% minder betrouwbaar en komen false positives daar relatief vaker voor.
Ook andere aanbieders waarschuwen tegen te stellige conclusies. GPTZero schrijft dat geen enkele AI-detector 100% nauwkeurig is. QuillBot noemt detectorscores expliciet signalen en geen definitieve oordelen, terwijl Originality.ai adviseert een score niet zelfstandig te gebruiken voor beslissingen met grote gevolgen.
Een detectorscore is dus een signaal om verder te kijken, geen bewijs dat iemand ChatGPT of een andere AI-tool heeft gebruikt.
Wil je breder leren beoordelen of AI-output betrouwbaar is, lees dan ook hoe je AI-antwoorden controleert.