Leestijd

Gebruiken kandidaten ChatGPT bij assessments? Zo beïnvloedt het de uitslag

Ja, kandidaten gebruiken ChatGPT bij assessments, en het beïnvloedt de uitslag vooral bij open schrijfopdrachten en thuisopdrachten. In een blind experiment (PLOS ONE) werden 63 AI-antwoorden in een echt examensysteem ingediend. 94% bleef onopgemerkt en scoorde gemiddeld hoger dan echte studenten. AI-detectors zijn geen betrouwbaar bewijs. Wat wel werkt is een ander assessmentontwerp, gedragsmonitoring en menselijke beoordeling.

Dat onderzoek ging over een universiteit, niet over een sollicitatieprocedure. Toch is het signaal moeilijk te negeren. Assessments die ontworpen zijn voor een wereld zonder taalmodellen meten nu soms iets anders dan ze beloven, en dat raakt de voorspellende waarde van je selectie.

Deze gids is voor TA-leads, recruitmentmanagers en assessmentontwerpers die daar nu iets mee moeten. Je krijgt een overzicht van welke formats kwetsbaar zijn, ontwerpprincipes, een monitoringkader, een draaiboek en een set KPI's om het te volgen.

Wat je nodig hebt. Toegang tot je huidige assessmentconfiguratie, een basisbegrip van je itemtypen en het mandaat (of de afstemming) om minstens één assessmentflow aan te passen.

Doorlooptijd. Reken op 1 tot 2 weken voor beleid en monitoring, en 4 tot 6 weken voor een volledig herontwerp van het assessment.

Welke assessmentvormen zijn het kwetsbaarst voor ChatGPT

Niet elk format loopt hetzelfde risico. Drie dingen bepalen hoe kwetsbaar een opdracht is. Wordt hij zonder toezicht gemaakt, hoeveel tekst levert hij op, en leg je naast het antwoord ook iets vast over het proces?

FormatKwetsbaarheidWaaromWat je in plaats daarvan doet
Open schrijfopdracht zonder toezichtHoogStatische, onbegrensde tekst; geen zicht op het procesTijdslimiet per item; voeg halverwege een sessiespecifieke beperking toe
ThuisopdrachtHoogVolledig zonder toezicht; een taalmodel kan eindeloos bijschavenVraag een toelichting op de gemaakte keuzes; laat een vervolggesprek volgen
SJT met open tekstantwoordGemiddeldOnderzoek (ScienceDirect, oktober 2024) laat kleine scoreverschuivingen zien, maar duidelijk andere antwoordpatronenStap over op forced-choice of rangschikken
Verbaal redeneren / capaciteitentestGemiddeld tot hoogTaalmodellen redeneren veel itemtypen uit, zeker bij ruime tijdAdaptieve timing; parallelle itempools
Codeer- of technische testGemiddeldDeels te controleren via runtime checks, maar prompt-injectie komt veel voorWerk in een browser-IDE met schermopname; vraag om uitleg van de logica
Live gestructureerd interviewLaagRealtime en interactief; lastig midden in een gesprek uit te bestedenInformeer kandidaten vooraf over je AI-beleid

Een studie in Wiley Online Library (gepubliceerd op 9 maart 2026, 5.675 respondenten) vond dat minder dan 3% van de sollicitanten zelf aangaf generatieve AI te gebruiken, maar in specifieke assessmentfases liep dat op tot 19%. Zelfrapportage onderschat het werkelijke gebruik. Het verschil per fase vertelt je wel waar je je maatregelen op richt.

Zo ontwerp je een assessment dat ChatGPT niet voor de kandidaat kan maken

De betrouwbaarste maatregel is niet detectie. Het is de opdracht zo bouwen dat uitbesteden structureel moeilijk wordt.

Vraag om procesbewijs, niet alleen om antwoorden. Wie een probleem zelf heeft opgelost, kan zijn redenering uitleggen als je doorvraagt. Een geplakt AI-antwoord meestal niet. Vraag in een SJT voor klantenservice niet alleen "Wat zou je doen?" maar ook welk stukje informatie uit het scenario het zwaarst woog en waarom. Dat dwingt de kandidaat iets te doen met sessiespecifieke inhoud die een taalmodel niet heeft gezien.

Begrens de tijd en laat scenario's vertakken. Kortere tijdvensters per item dan een kandidaat nodig heeft om te kopiëren, plakken en nalezen, halen een groot deel van het voordeel weg bij tekstzware items. Vertakking, waarbij de volgende vraag afhangt van het vorige antwoord, maakt hergebruik van prompts nutteloos. Een AI-antwoord op vraag 2 slaat nergens op als het niet is gebouwd op het echte antwoord van de kandidaat op vraag 1.

Gebruik parallelle itempools. Als elke kandidaat hetzelfde magazijnscenario krijgt, staat dat scenario vroeg of laat online. Bouw minstens drie structureel gelijkwaardige varianten met andere contextdetails. Dat bemoeilijkt het matchen van prompts en verlengt de levensduur van je itembank.

Combineer formats. Een modulair assessment met een forced-choice SJT, een cognitieve game met tijdslimiet en een korte video-opdracht is veel lastiger systematisch te omzeilen dan één open tekstopdracht. Je dekt per sessie ook meer competenties af.

Proctoring en monitoring, wat je vastlegt en waarom

ChatGPT-gebruik bij assessments is een integriteitsvraag, maar welk middel je kiest om het te signaleren bepaalt hoe eerlijk je proces blijft.

AI-tekstdetectors (zoals GPTZero) werken op kansverdelingen in tekstkenmerken, en hun foutmarge is in de praktijk fors. Turnitin geeft in zijn eigen richtlijnen (juli 2024) geen detectiescore bij een AI-kans tussen 1 en 19%, juist om valse positieven te vermijden. Zelfs met een gestelde ambitie van minder dan 1% valse positieven (Turnitin, maart 2023) schatte Jisc (juni 2025) dat die 1% op instellingsschaal neerkomt op ongeveer 4.800 onterechte markeringen per jaar. In een wervingscontext, waar een onterechte vlag een geschikte kandidaat uitsluit, is dat als enig bewijs niet te verdedigen.

Gedragsmonitoring levert een ander soort bewijs. Waarneembare signalen zoals focuswisselingen (tabbladen, andere applicaties), klembordactiviteit, onregelmatig typritme en afwijkende sessietiming zijn gebaseerd op gedrag en door een mens te beoordelen. Ze bewijzen AI-gebruik niet sluitend, maar ze geven een controleerbaar spoor voor een onderbouwd menselijk oordeel.

De proctoringconfiguratie van Selection Lab legt met toestemming van de kandidaat camera, audio en scherm vast en toont integriteitssignalen over of er tijdens de sessie tools zoals ChatGPT zijn gebruikt. Alleen al openlijk melden dat er wordt opgenomen werkt afschrikkend. Kandidaten die weten dat de sessie wordt vastgelegd, proberen minder snel iets uit te besteden.

Over de AVG en de EU AI Act. Toestemming moet expliciet en gespecificeerd zijn (camera, audio en scherm waar nodig als aparte categorieën), bewaartermijnen moeten vastliggen en minimaal zijn, en een negatief besluit dat uitsluitend op een AI-vlag rust is onder de hoogrisicovereisten van de EU AI Act niet toegestaan. Er moet altijd een menselijke beoordelingsstap in zitten. Hoe je dat in de praktijk regelt lees je in onze blog over bezwaar maken tegen een AI-beslissing.

Signalen die beoordeling verdienen, per format

  • Schrijfopdrachten. Afrondtijd onder 40% van de mediaan; één grote plakactie; geen enkele pauze in het typen
  • SJT's. Antwoorden die niet kloppen met eerdere feiten in de sessie; gelijkenis met bekende AI-output boven een drempel
  • Cognitief / capaciteiten. Uitschieters in snelheid met bijna foutloze antwoorden; invoerpatroon dat afwijkt van de populatie

Draaiboek voor, tijdens en na het assessment

Voordat het assessment opengaat

  1. Publiceer een helder AI-beleid per fase van je funnel. Benoem wat mag (bijvoorbeeld AI gebruiken om een gesprek voor te bereiden) en wat niet (bijvoorbeeld ChatGPT tijdens een getimed assessment). Zet dit bij registratie en op het introductiescherm van het assessment.
  2. Richt parallelle itempools in en stel tijdslimieten per item in op je assessmentplatform.
  3. Bepaal vooraf je beoordelingsdrempels. Welke afwijkingen leiden tot menselijke beoordeling en welke tot een automatische herkansing?
  4. Controleer of de toestemmingsflow voor proctoring actief is en dat kandidaten vóór de start duidelijk worden geïnformeerd.

Tijdens het assessment

  1. Zet browser-lockdown aan waar de inzet hoog is. Dat blokkeert tabbladwisselingen en het klembord zonder dat je voor elke fase volledige proctoring nodig hebt.
  2. Gebruik adaptieve timing. Baseer het tijdvenster per item op wat een kandidaat zonder hulp nodig heeft, niet op een ruime marge.
  3. Stel realtime meldingen in voor uitschieters in afrondtijd of voor herhaalde focuswisselingen boven een drempel.

Na het assessment

  1. Laat gemarkeerde sessies door een mens beoordelen vóór er een besluit valt. Leg de waargenomen afwijkingen en de redenering van de beoordelaar vast.
  2. Pas terugvalregels consequent toe. Bij twijfel plan je een herkansing in plaats van uit te sluiten. Bij sterke, bevestigde gedragssignalen verwerp je het resultaat met vastgelegde onderbouwing. Bij kleine signalen en een verder valide score accepteer je met een notitie en laat je het gesprek zwaarder wegen.
  3. Log elk integriteitsbesluit voor de audittrail, zeker gezien de hoogrisicoclassificatie onder de EU AI Act.

Welke KPI's je bijhoudt

Leg een nulmeting vast voordat je de aangepaste assessments uitrolt, en kijk na 30 en 90 dagen opnieuw.

Integriteitsmonitoring

  • Percentage sessies met minstens één signaal dat beoordeling verdient
  • Aantal focuswisselingen per sessie, per format
  • Percentage schriftelijke antwoorden boven de drempel voor gelijkenis met AI-output
  • Doorlooptijd van vlag tot besluit
  • Herkansingspercentage en samenhang met de uitkomst

Validiteit van het assessment

  • Stabiliteit van het slagingspercentage voor en na het herontwerp (grote verschuivingen kunnen wijzen op gecorrigeerde score-inflatie, of op nieuw geïntroduceerde adverse impact)
  • Adverse-impactanalyse op beschermde kenmerken
  • Samenhang met prestaties later, waar 90-dagenbeoordelingen van managers of cijfers over vroeg verloop beschikbaar zijn. Klanten van Selection Lab die de volledige workflow gebruiken, rapporteerden 21% minder vroeg verloop (januari 2024). Dat is een bruikbare proxy voor kwaliteit van hire om naast je nulmeting te leggen.

Operationele efficiëntie

  • Bespaarde tijd per sollicitant in de gescreende funnel
  • Uitval per assessmentfase (een herontwerp mag de uitval niet verhogen; de intake- en assessmentflow van Selection Lab liet in maart 2025 27% minder uitval zien)

Implementatiechecklist

  • AI-beleid gepubliceerd en van een versienummer voorzien
  • Parallelle itempools ingericht (minimaal 3 varianten per scenario)
  • Tijdslimieten per item ingesteld en getest
  • Toestemmingsflow voor proctoring actief met AVG-conforme bewaartermijnen
  • Drempels voor afwijkingen vastgelegd en gedocumenteerd
  • Menselijke beoordeling toegewezen met een afgesproken doorlooptijd
  • Nulmeting van integriteits- en validiteitsmetrics vastgelegd
  • Evaluatiemomenten na 30 en 90 dagen ingepland

Het onderzoeksbeeld is duidelijk genoeg om op te handelen. Generatieve AI wordt gebruikt bij assessments, het effect op de uitslag hangt af van het format, en tekstdetectors zijn geen afdoende maatregel. Het antwoord is een ander assessmentontwerp plus gedragsmonitoring plus gestructureerde menselijke beoordeling. Die combinatie, ingebouwd in een modulair assessmentplatform met eigen integriteitstooling, maakt van een compliancerisico een beheersbaar en controleerbaar proces.

Veelgestelde vragen over ChatGPT bij assessments

Gebruiken kandidaten echt ChatGPT bij een assessment?

Ja. In een Wiley-studie onder 5.675 sollicitanten gaf minder dan 3% aan generatieve AI te gebruiken, maar in specifieke assessmentfases liep dat op tot 19%. Zelfrapportage onderschat het echte gebruik. In een blind PLOS ONE-experiment bleef 94% van de AI-antwoorden onopgemerkt en scoorden ze hoger dan echte inzendingen.

Bij welke assessments is fraude met ChatGPT het makkelijkst?

Open schrijfopdrachten zonder toezicht en thuisopdrachten lopen het grootste risico, omdat ze onbewaakt zijn en vrije tekst opleveren. Verbale redeneertesten zitten op gemiddeld tot hoog risico als de tijd ruim is. SJT's met tekstantwoord en codeertesten zijn gemiddeld. Een live gestructureerd interview is het lastigst uit te besteden.

Kan een AI-detector bewijzen dat een kandidaat ChatGPT heeft gebruikt?

Nee. Tekstdetectors werken op kansverdelingen en geven valse positieven in een mate die bij werving telt. Turnitin geeft daarom geen score bij een AI-kans tussen 1 en 19%, en Jisc schatte dat 1% valse positieven op instellingsschaal alsnog ongeveer 4.800 onterechte markeringen per jaar oplevert. Gedragssignalen plus menselijke beoordeling zijn de verdedigbare bewijsstandaard.

Hoe maak je een assessment bestendig tegen ChatGPT?

Vraag om procesbewijs in plaats van alleen antwoorden, begrens de tijd per item, laat scenario's vertakken zodat de volgende vraag afhangt van het vorige antwoord, gebruik minimaal drie parallelle varianten per scenario en combineer formats, bijvoorbeeld een forced-choice SJT, een cognitieve game met tijdslimiet en een korte video-opdracht in één flow.

Mag je kandidaten monitoren op AI-gebruik onder de AVG en de EU AI Act?

Ja, onder voorwaarden. Toestemming moet expliciet en per gegevenstype (camera, audio, scherm) worden gegeven, bewaartermijnen moeten vastliggen en minimaal zijn, en geen enkel negatief besluit mag uitsluitend op een automatische vlag rusten. Een mens beoordeelt elke gemarkeerde sessie voordat er een besluit valt.

FAQ

Kunnen game-based assessments de diversiteit in het wervingsproces bevorderen?

Ja, game-based assessments kunnen de diversiteit bevorderen door de focus te leggen op vaardigheden en gedrag in plaats van op traditionele criteria zoals cv's, die onbewuste vooroordelen kunnen bevatten. Hierdoor krijgen kandidaten met uiteenlopende achtergronden een gelijke kans om hun potentieel te demonstreren.

Wat is een game-based assessment?

Een game-based assessment is een testmethode die gebruikmaakt van spelmechanismen om de vaardigheden, competenties en persoonlijkheidskenmerken van kandidaten te evalueren. Tijdens het spelen van deze games worden verschillende aspecten, zoals probleemoplossend vermogen, cognitieve capaciteiten en gedrag onder druk, op een interactieve manier beoordeeld.

Wat zijn de voordelen van game-based assessments?

Game-based assessments kunnen een interactieve en boeiende ervaring bieden voor kandidaten, wat voor bepaalde doelgroepen kan bijdragen aan een positiever beeld van het sollicitatieproces. Voor werkgevers kunnen deze assessments diepgaand inzicht geven in zowel cognitieve als gedragsmatige kwaliteiten op een manier die traditionele tests mogelijk niet bieden. Daarnaast kunnen ze de kans op sociaal wenselijk gedrag verminderen, omdat kandidaten in een game-omgeving vaak meer authentiek en spontaan reageren.

Hoe betrouwbaar zijn game-based assessments vergeleken met traditionele tests?

Als ze goed ontworpen zijn, kunnen game-based assessments even betrouwbaar en in sommige gevallen zelfs betrouwbaarder zijn dan traditionele tests, omdat ze een breed scala aan gedragsindicatoren en cognitieve vaardigheden meten in een dynamische setting. Er is echter wel een groot verschil in kwaliteit tussen de verschillende game-based assessments, dus let hier goed op.

Hoe werkt een game-based assessment?

Bij een game-based assessment nemen kandidaten deel aan interactieve spellen die zijn ontworpen om specifieke vaardigheden en gedragingen te meten. Tijdens het spel wordt niet alleen het eindresultaat geanalyseerd, maar ook hoe de kandidaat beslissingen neemt, reageert op uitdagingen en omgaat met verschillende scenario's. Deze observaties geven inzicht in hun denkprocessen en gedragspatronen.

Zijn game-based assessments wetenschappelijk onderbouwd?

Het grote nadeel van game based assessments is dat ze relatief nieuw zijn, dus dat veel game-based assessments nog niet tot nauwelijks onderzocht zijn door onafhankelijke onderzoekers. Veel partijen halen hun eigen onderzoek(en) aan, maar dit is zelden onafhankelijk getoetst. Zonder onafhankelijk onderzoek kun je de betrouwbaarheid van game based assessments niet zeker weten. Wees je hiervan bewust bij het selecteren van het best passende assessment.

Hoe kunnen game-based assessments bijdragen aan een betere kandidaatervaring?

Dit verschilt sterk per doelgroep. Doordat game-based assessments speels en interactief zijn, ervaren bepaalde groepen kandidaten minder stress dan bij traditionele tests. Onderzoek toont aan dat bepaalde doelgroepen (met name kandidaten boven de 35 jaar) juist meer stress ervaren van een game. Ook komt uit onderzoek dat mannen games als positiever ervaren dan vrouwen.

Kun je game-based assessments oefenen?

Hoewel je je kunt vertrouwd maken met het type games dat wordt gebruikt, zijn game-based assessments moeilijk specifiek te oefenen. Ze zijn ontworpen om natuurlijke reacties en authentiek gedrag te meten, waardoor repetitieve oefening minder invloed heeft op de uitkomst dan bij traditionele tests.

Zullen game-based assessments traditionele tests vervangen in de toekomst?

Het is waarschijnlijk dat game-based assessments een grotere rol zullen spelen in toekomstige wervingsprocessen, maar een volledige vervanging van traditionele tests is onzeker. Beide methoden kunnen elkaar aanvullen en worden ingezet afhankelijk van de specifieke eisen van de functie en de voorkeuren van het bedrijf.

Hoe worden de resultaten van een game-based assessment geanalyseerd en geïnterpreteerd?

De resultaten van een game-based assessment worden geanalyseerd op basis van vooraf vastgestelde parameters zoals probleemoplossend vermogen, reactietijd en gedrag onder druk. Geavanceerde algoritmen verzamelen en verwerken automatisch de data om een objectieve en betrouwbare beoordeling van de competenties en vaardigheden van de kandidaat te bieden.

Welke vaardigheden worden gemeten in een game-based assessment?

Game-based assessments meten een breed scala aan vaardigheden. Ze evalueren bijvoorbeeld het probleemoplossend vermogen, het aanpassingsvermogen, de besluitvorming onder druk, samenwerking en emotionele intelligentie van een kandidaat. Afhankelijk van het specifieke ontwerp kunnen ook cognitieve vaardigheden zoals geheugen, aandacht en patroonherkenning worden beoordeeld.

Hoe lang duurt een game-based assessment?

De duur van een game-based assessment varieert, maar meestal duurt het tussen de 15 en 60 minuten. Dit hangt af van de complexiteit van de game en het aantal vaardigheden dat wordt gemeten. Vaak zijn deze assessments korter en interactiever dan traditionele tests, wat kan bijdragen aan een speelse kandidaatervaring.

Zijn game-based assessments geschikt voor alle functies?

Game-based assessments zijn vooral geschikt voor functies waarbij cognitieve flexibiliteit, creativiteit, probleemoplossend vermogen en interpersoonlijke vaardigheden cruciaal zijn. Voor zeer technische of specialistische rollen kunnen aanvullende tests of evaluaties nodig zijn om specifieke kennis en expertise te meten.

Wat is het verschil tussen een game-based assessment en een gamified assessment?

Het verschil tussen een game-based assessment en een gamified assessment ligt in de mate waarin speltechnieken worden geïntegreerd. Bij een gamified assessment worden traditionele tests verrijkt met spelelementen om de betrokkenheid te vergroten, terwijl bij een game-based assessment de game zelf het primaire instrument is voor evaluatie. In een game-based assessment worden kandidaten beoordeeld op basis van hun interactie binnen de game, die is ontworpen om specifieke competenties te meten.

FAQ

Hoe kan ik het retentiepercentage van mijn bedrijf verbeteren?

Het retentiepercentage kan worden verbeterd door te investeren in de ontwikkeling en tevredenheid van medewerkers. Dit omvat het aanbieden van trainingen, carrièrekansen en erkenning voor hun bijdragen. Een open communicatiecultuur en aandacht voor werk-privébalans kunnen eveneens bijdragen aan hogere retentie. Daarnaast kan het bieden van concurrerende arbeidsvoorwaarden en het betrekken van medewerkers bij besluitvorming de loyaliteit versterken.

Wat zijn de voordelen van doorgroeimogelijkheden voor personeelsbehoud?

Doorgroeimogelijkheden kunnen het behoud van personeel bevorderen door medewerkers een gevoel van richting en motivatie te geven. Wanneer zij de kans krijgen om te leren en zich professioneel te ontwikkelen binnen het bedrijf, voelen zij zich gewaardeerd, wat hun loyaliteit vergroot. Dit kan voorkomen dat ze vertrekken om elders betere kansen te zoeken.

Wat zijn de belangrijkste factoren die personeelsretentie beïnvloeden?

Belangrijke factoren die personeelsretentie beïnvloeden zijn onder meer salaris en secundaire arbeidsvoorwaarden, mogelijkheden voor professionele ontwikkeling, werk-privébalans, bedrijfscultuur en de relatie met leidinggevenden. Medewerkers blijven vaak langer wanneer ze zich gewaardeerd, uitgedaagd en ondersteund voelen in hun werkomgeving.

Waarom is personeelsretentie zo belangrijk voor organisaties?

Personeelsretentie is belangrijk omdat het helpt bij het verminderen van kosten voor werving en training van nieuwe medewerkers, en bijdraagt aan het behoud van kennis en ervaring binnen de organisatie. Een hoge retentie zorgt ook voor continuïteit binnen teams, wat kan leiden tot een stabielere bedrijfscultuur, hogere klanttevredenheid en verbeterde bedrijfsresultaten.

Welke wervingsstrategieën helpen bij het verhogen van retentie?

Wervingsstrategieën die de retentie kunnen verhogen, omvatten het identificeren van kandidaten die passen bij de bedrijfscultuur, het gebruik van assessments om soft skills te evalueren en het bieden van transparantie over rolverwachtingen tijdens het sollicitatieproces. Medewerkers die zich verbonden voelen met de organisatie en duidelijkheid hebben over hun functie, zijn geneigd langer te blijven.

Hoe kan een goed onboardingsproces bijdragen aan hogere retentie?

Een effectief onboardingsproces kan bijdragen aan hogere retentie door nieuwe medewerkers te helpen zich snel aan te passen aan hun rol, de bedrijfscultuur en de verwachtingen. Door vanaf het begin ondersteuning en duidelijke informatie te bieden, wordt hun betrokkenheid vergroot en de kans verkleind dat ze vroegtijdig vertrekken vanwege gevoelens van overweldiging of gebrek aan begeleiding.

Wat is de rol van bedrijfscultuur in het behoud van personeel?

De bedrijfscultuur speelt een cruciale rol in het behoud van personeel. Wanneer medewerkers zich gehoord, gewaardeerd en verbonden voelen met de waarden en normen van het bedrijf, is de kans groter dat ze blijven. Een positieve cultuur die samenwerking, respect en persoonlijke groei stimuleert, kan de motivatie en tevredenheid van medewerkers aanzienlijk vergroten.

Hoe kunnen leiderschap en managementstijl de retentie beïnvloeden?

Leiderschap en managementstijl hebben een significante invloed op retentie. Leiders die hun team inspireren, ondersteunen en coachen, kunnen de betrokkenheid en tevredenheid van medewerkers verhogen. Het bieden van autonomie en vertrouwen kan leiden tot hogere loyaliteit, terwijl een inefficiënte of negatieve managementstijl kan bijdragen aan ontevredenheid en verhoogd personeelsverloop.

Wat is het belang van erkenning en beloningen voor personeelsbehoud?

Erkenning en beloningen spelen een belangrijke rol in personeelsbehoud door medewerkers te laten zien dat hun werk wordt gewaardeerd. Dit kan hun motivatie en loyaliteit verhogen. Naast financiële beloningen kunnen ook complimenten, promoties en andere vormen van erkenning bijdragen aan tevredenheid en het behouden van personeel.

Welke rol speelt werk-privébalans in het verhogen van retentie?

Een evenwichtige werk-privébalans speelt een belangrijke rol in het verhogen van retentie. Door stress te verminderen en werktevredenheid te vergroten, blijven medewerkers vaak langer bij het bedrijf. Initiatieven zoals flexibele werktijden, mogelijkheden voor thuiswerken en respect voor persoonlijke tijd kunnen bijdragen aan deze balans.

Wat betekent retentie verhogen binnen een bedrijf?

Retentie verhogen binnen een bedrijf houdt in dat je strategieën implementeert om medewerkers langer aan de organisatie te binden. Dit kan door het verbeteren van werktevredenheid, het aanbieden van doorgroeimogelijkheden en het bevorderen van een positieve en ondersteunende bedrijfscultuur.

Hoe meet ik het succes van mijn retentiestrategie?

Het succes van een retentiestrategie kan worden gemeten door het bijhouden van retentiepercentages en verloopcijfers, en door inzichten te verkrijgen uit exitgesprekken. Daarnaast kunnen enquêtes over medewerkerstevredenheid en feedback uit evaluatiegesprekken waardevolle informatie bieden over de effectiviteit van de toegepaste strategieën.

Wat zijn de kosten van een laag retentiepercentage?

Een laag retentiepercentage kan aanzienlijke kosten met zich meebrengen, zoals verhoogde uitgaven voor werving en training van nieuwe medewerkers. Bovendien kan het verlies van ervaren personeel leiden tot lagere productiviteit, verminderde kennisoverdracht en een negatieve invloed op de bedrijfscultuur.

Hoe kan ik medewerkersbetrokkenheid verhogen?

Om medewerkersbetrokkenheid te verhogen, kun je hen betrekken bij besluitvormingsprocessen, regelmatig om hun feedback vragen en erkenning geven voor hun bijdragen. Het aanbieden van ontwikkelingsmogelijkheden en het onderhouden van transparante communicatie kunnen eveneens bijdragen aan een grotere betrokkenheid.

Hoe kan technologie helpen bij het verbeteren van personeelsretentie?

Technologie kan een hulpmiddel zijn bij het verbeteren van personeelsretentie door het faciliteren van communicatie, feedback en ontwikkeling. Door gebruik te maken van online platforms voor training, erkenning en evaluatie, kunnen bedrijven een meer betrokken en tevreden personeelsbestand creëren.

FAQ

Hoe lang duurt het om de tool te doorlopen?

Minder dan 10 minuten. Je doorloopt 30 vragen en krijgt daarna een overzicht van waar je op moet letten bij je volgende assessmentplatform.

Helpt deze checklist bij het vergelijken van assessmentaanbieders?

Ja. Doordat je scherp krijgt wat voor jouw team echt belangrijk is, wordt het vergelijken van functionaliteit, prijs en sterke punten van aanbieders eenvoudiger en strategischer.

Hoe gebruik ik deze checklist zonder formele RFI?

De checklist is net zo waardevol voor een interne evaluatie, voor het verkennen van nieuwe tools of voor het verbeteren van je huidige selectieproces, ook als je geen RFI of RFQ uitzet.

Waar moet je op letten bij een modern assessmentplatform?

Geef voorrang aan platformen met een gebruiksvriendelijk ontwerp, goede werking op mobiel, sterke analytics, koppelingen met je ATS en inclusieve functionaliteit zoals ondersteuning voor neurodiversiteit.

Welke soorten assessments zijn in 2026 relevant?

De sterkste platformen combineren capaciteitentesten, situational judgement tests, gedragsassessments en voorspellende AI, zodat je een kandidaat completer beoordeelt dan met één los instrument.

Voor wie is een assessmentchecklist bedoeld?

Voor HR-professionals, hiring managers en inkoopteams die oplossingen voor voorselectie beoordelen, en in het bijzonder voor wie AI-gestuurde of compliance-gedreven assessmentplatformen met elkaar vergelijkt.

Hoe helpt deze checklist bij een RFI of RFQ voor assessments?

Met de checklist breng je je eisen scherp in kaart, zodat je met vertrouwen een Request for Information of Request for Quotation voor assessmenttools kunt opstellen of beantwoorden.

Wat is een assessmenttool in werving en selectie?

Een assessmenttool beoordeelt de vaardigheden, het gedrag en de match van kandidaten tijdens het wervingsproces. Daarmee onderbouw je aannamebeslissingen beter en verloopt de voorselectie soepeler.

Game-based assessment packs

← Blog

Gebruiken kandidaten ChatGPT bij assessments? Zo beïnvloedt het de uitslag

Ja, kandidaten gebruiken ChatGPT bij assessments. Welke formats het kwetsbaarst zijn, waarom AI-detectors niet volstaan en wat je wel doet.
Joeri Everaers
COO
Leestijd: ca.

Ja, kandidaten gebruiken ChatGPT bij assessments, en het beïnvloedt de uitslag vooral bij open schrijfopdrachten en thuisopdrachten. In een blind experiment (PLOS ONE) werden 63 AI-antwoorden in een echt examensysteem ingediend. 94% bleef onopgemerkt en scoorde gemiddeld hoger dan echte studenten. AI-detectors zijn geen betrouwbaar bewijs. Wat wel werkt is een ander assessmentontwerp, gedragsmonitoring en menselijke beoordeling.

Dat onderzoek ging over een universiteit, niet over een sollicitatieprocedure. Toch is het signaal moeilijk te negeren. Assessments die ontworpen zijn voor een wereld zonder taalmodellen meten nu soms iets anders dan ze beloven, en dat raakt de voorspellende waarde van je selectie.

Deze gids is voor TA-leads, recruitmentmanagers en assessmentontwerpers die daar nu iets mee moeten. Je krijgt een overzicht van welke formats kwetsbaar zijn, ontwerpprincipes, een monitoringkader, een draaiboek en een set KPI's om het te volgen.

Wat je nodig hebt. Toegang tot je huidige assessmentconfiguratie, een basisbegrip van je itemtypen en het mandaat (of de afstemming) om minstens één assessmentflow aan te passen.

Doorlooptijd. Reken op 1 tot 2 weken voor beleid en monitoring, en 4 tot 6 weken voor een volledig herontwerp van het assessment.

Welke assessmentvormen zijn het kwetsbaarst voor ChatGPT

Niet elk format loopt hetzelfde risico. Drie dingen bepalen hoe kwetsbaar een opdracht is. Wordt hij zonder toezicht gemaakt, hoeveel tekst levert hij op, en leg je naast het antwoord ook iets vast over het proces?

FormatKwetsbaarheidWaaromWat je in plaats daarvan doet
Open schrijfopdracht zonder toezichtHoogStatische, onbegrensde tekst; geen zicht op het procesTijdslimiet per item; voeg halverwege een sessiespecifieke beperking toe
ThuisopdrachtHoogVolledig zonder toezicht; een taalmodel kan eindeloos bijschavenVraag een toelichting op de gemaakte keuzes; laat een vervolggesprek volgen
SJT met open tekstantwoordGemiddeldOnderzoek (ScienceDirect, oktober 2024) laat kleine scoreverschuivingen zien, maar duidelijk andere antwoordpatronenStap over op forced-choice of rangschikken
Verbaal redeneren / capaciteitentestGemiddeld tot hoogTaalmodellen redeneren veel itemtypen uit, zeker bij ruime tijdAdaptieve timing; parallelle itempools
Codeer- of technische testGemiddeldDeels te controleren via runtime checks, maar prompt-injectie komt veel voorWerk in een browser-IDE met schermopname; vraag om uitleg van de logica
Live gestructureerd interviewLaagRealtime en interactief; lastig midden in een gesprek uit te bestedenInformeer kandidaten vooraf over je AI-beleid

Een studie in Wiley Online Library (gepubliceerd op 9 maart 2026, 5.675 respondenten) vond dat minder dan 3% van de sollicitanten zelf aangaf generatieve AI te gebruiken, maar in specifieke assessmentfases liep dat op tot 19%. Zelfrapportage onderschat het werkelijke gebruik. Het verschil per fase vertelt je wel waar je je maatregelen op richt.

Zo ontwerp je een assessment dat ChatGPT niet voor de kandidaat kan maken

De betrouwbaarste maatregel is niet detectie. Het is de opdracht zo bouwen dat uitbesteden structureel moeilijk wordt.

Vraag om procesbewijs, niet alleen om antwoorden. Wie een probleem zelf heeft opgelost, kan zijn redenering uitleggen als je doorvraagt. Een geplakt AI-antwoord meestal niet. Vraag in een SJT voor klantenservice niet alleen "Wat zou je doen?" maar ook welk stukje informatie uit het scenario het zwaarst woog en waarom. Dat dwingt de kandidaat iets te doen met sessiespecifieke inhoud die een taalmodel niet heeft gezien.

Begrens de tijd en laat scenario's vertakken. Kortere tijdvensters per item dan een kandidaat nodig heeft om te kopiëren, plakken en nalezen, halen een groot deel van het voordeel weg bij tekstzware items. Vertakking, waarbij de volgende vraag afhangt van het vorige antwoord, maakt hergebruik van prompts nutteloos. Een AI-antwoord op vraag 2 slaat nergens op als het niet is gebouwd op het echte antwoord van de kandidaat op vraag 1.

Gebruik parallelle itempools. Als elke kandidaat hetzelfde magazijnscenario krijgt, staat dat scenario vroeg of laat online. Bouw minstens drie structureel gelijkwaardige varianten met andere contextdetails. Dat bemoeilijkt het matchen van prompts en verlengt de levensduur van je itembank.

Combineer formats. Een modulair assessment met een forced-choice SJT, een cognitieve game met tijdslimiet en een korte video-opdracht is veel lastiger systematisch te omzeilen dan één open tekstopdracht. Je dekt per sessie ook meer competenties af.

Proctoring en monitoring, wat je vastlegt en waarom

ChatGPT-gebruik bij assessments is een integriteitsvraag, maar welk middel je kiest om het te signaleren bepaalt hoe eerlijk je proces blijft.

AI-tekstdetectors (zoals GPTZero) werken op kansverdelingen in tekstkenmerken, en hun foutmarge is in de praktijk fors. Turnitin geeft in zijn eigen richtlijnen (juli 2024) geen detectiescore bij een AI-kans tussen 1 en 19%, juist om valse positieven te vermijden. Zelfs met een gestelde ambitie van minder dan 1% valse positieven (Turnitin, maart 2023) schatte Jisc (juni 2025) dat die 1% op instellingsschaal neerkomt op ongeveer 4.800 onterechte markeringen per jaar. In een wervingscontext, waar een onterechte vlag een geschikte kandidaat uitsluit, is dat als enig bewijs niet te verdedigen.

Gedragsmonitoring levert een ander soort bewijs. Waarneembare signalen zoals focuswisselingen (tabbladen, andere applicaties), klembordactiviteit, onregelmatig typritme en afwijkende sessietiming zijn gebaseerd op gedrag en door een mens te beoordelen. Ze bewijzen AI-gebruik niet sluitend, maar ze geven een controleerbaar spoor voor een onderbouwd menselijk oordeel.

De proctoringconfiguratie van Selection Lab legt met toestemming van de kandidaat camera, audio en scherm vast en toont integriteitssignalen over of er tijdens de sessie tools zoals ChatGPT zijn gebruikt. Alleen al openlijk melden dat er wordt opgenomen werkt afschrikkend. Kandidaten die weten dat de sessie wordt vastgelegd, proberen minder snel iets uit te besteden.

Over de AVG en de EU AI Act. Toestemming moet expliciet en gespecificeerd zijn (camera, audio en scherm waar nodig als aparte categorieën), bewaartermijnen moeten vastliggen en minimaal zijn, en een negatief besluit dat uitsluitend op een AI-vlag rust is onder de hoogrisicovereisten van de EU AI Act niet toegestaan. Er moet altijd een menselijke beoordelingsstap in zitten. Hoe je dat in de praktijk regelt lees je in onze blog over bezwaar maken tegen een AI-beslissing.

Signalen die beoordeling verdienen, per format

  • Schrijfopdrachten. Afrondtijd onder 40% van de mediaan; één grote plakactie; geen enkele pauze in het typen
  • SJT's. Antwoorden die niet kloppen met eerdere feiten in de sessie; gelijkenis met bekende AI-output boven een drempel
  • Cognitief / capaciteiten. Uitschieters in snelheid met bijna foutloze antwoorden; invoerpatroon dat afwijkt van de populatie

Draaiboek voor, tijdens en na het assessment

Voordat het assessment opengaat

  1. Publiceer een helder AI-beleid per fase van je funnel. Benoem wat mag (bijvoorbeeld AI gebruiken om een gesprek voor te bereiden) en wat niet (bijvoorbeeld ChatGPT tijdens een getimed assessment). Zet dit bij registratie en op het introductiescherm van het assessment.
  2. Richt parallelle itempools in en stel tijdslimieten per item in op je assessmentplatform.
  3. Bepaal vooraf je beoordelingsdrempels. Welke afwijkingen leiden tot menselijke beoordeling en welke tot een automatische herkansing?
  4. Controleer of de toestemmingsflow voor proctoring actief is en dat kandidaten vóór de start duidelijk worden geïnformeerd.

Tijdens het assessment

  1. Zet browser-lockdown aan waar de inzet hoog is. Dat blokkeert tabbladwisselingen en het klembord zonder dat je voor elke fase volledige proctoring nodig hebt.
  2. Gebruik adaptieve timing. Baseer het tijdvenster per item op wat een kandidaat zonder hulp nodig heeft, niet op een ruime marge.
  3. Stel realtime meldingen in voor uitschieters in afrondtijd of voor herhaalde focuswisselingen boven een drempel.

Na het assessment

  1. Laat gemarkeerde sessies door een mens beoordelen vóór er een besluit valt. Leg de waargenomen afwijkingen en de redenering van de beoordelaar vast.
  2. Pas terugvalregels consequent toe. Bij twijfel plan je een herkansing in plaats van uit te sluiten. Bij sterke, bevestigde gedragssignalen verwerp je het resultaat met vastgelegde onderbouwing. Bij kleine signalen en een verder valide score accepteer je met een notitie en laat je het gesprek zwaarder wegen.
  3. Log elk integriteitsbesluit voor de audittrail, zeker gezien de hoogrisicoclassificatie onder de EU AI Act.

Welke KPI's je bijhoudt

Leg een nulmeting vast voordat je de aangepaste assessments uitrolt, en kijk na 30 en 90 dagen opnieuw.

Integriteitsmonitoring

  • Percentage sessies met minstens één signaal dat beoordeling verdient
  • Aantal focuswisselingen per sessie, per format
  • Percentage schriftelijke antwoorden boven de drempel voor gelijkenis met AI-output
  • Doorlooptijd van vlag tot besluit
  • Herkansingspercentage en samenhang met de uitkomst

Validiteit van het assessment

  • Stabiliteit van het slagingspercentage voor en na het herontwerp (grote verschuivingen kunnen wijzen op gecorrigeerde score-inflatie, of op nieuw geïntroduceerde adverse impact)
  • Adverse-impactanalyse op beschermde kenmerken
  • Samenhang met prestaties later, waar 90-dagenbeoordelingen van managers of cijfers over vroeg verloop beschikbaar zijn. Klanten van Selection Lab die de volledige workflow gebruiken, rapporteerden 21% minder vroeg verloop (januari 2024). Dat is een bruikbare proxy voor kwaliteit van hire om naast je nulmeting te leggen.

Operationele efficiëntie

  • Bespaarde tijd per sollicitant in de gescreende funnel
  • Uitval per assessmentfase (een herontwerp mag de uitval niet verhogen; de intake- en assessmentflow van Selection Lab liet in maart 2025 27% minder uitval zien)

Implementatiechecklist

  • AI-beleid gepubliceerd en van een versienummer voorzien
  • Parallelle itempools ingericht (minimaal 3 varianten per scenario)
  • Tijdslimieten per item ingesteld en getest
  • Toestemmingsflow voor proctoring actief met AVG-conforme bewaartermijnen
  • Drempels voor afwijkingen vastgelegd en gedocumenteerd
  • Menselijke beoordeling toegewezen met een afgesproken doorlooptijd
  • Nulmeting van integriteits- en validiteitsmetrics vastgelegd
  • Evaluatiemomenten na 30 en 90 dagen ingepland

Het onderzoeksbeeld is duidelijk genoeg om op te handelen. Generatieve AI wordt gebruikt bij assessments, het effect op de uitslag hangt af van het format, en tekstdetectors zijn geen afdoende maatregel. Het antwoord is een ander assessmentontwerp plus gedragsmonitoring plus gestructureerde menselijke beoordeling. Die combinatie, ingebouwd in een modulair assessmentplatform met eigen integriteitstooling, maakt van een compliancerisico een beheersbaar en controleerbaar proces.

Veelgestelde vragen over ChatGPT bij assessments

Gebruiken kandidaten echt ChatGPT bij een assessment?

Ja. In een Wiley-studie onder 5.675 sollicitanten gaf minder dan 3% aan generatieve AI te gebruiken, maar in specifieke assessmentfases liep dat op tot 19%. Zelfrapportage onderschat het echte gebruik. In een blind PLOS ONE-experiment bleef 94% van de AI-antwoorden onopgemerkt en scoorden ze hoger dan echte inzendingen.

Bij welke assessments is fraude met ChatGPT het makkelijkst?

Open schrijfopdrachten zonder toezicht en thuisopdrachten lopen het grootste risico, omdat ze onbewaakt zijn en vrije tekst opleveren. Verbale redeneertesten zitten op gemiddeld tot hoog risico als de tijd ruim is. SJT's met tekstantwoord en codeertesten zijn gemiddeld. Een live gestructureerd interview is het lastigst uit te besteden.

Kan een AI-detector bewijzen dat een kandidaat ChatGPT heeft gebruikt?

Nee. Tekstdetectors werken op kansverdelingen en geven valse positieven in een mate die bij werving telt. Turnitin geeft daarom geen score bij een AI-kans tussen 1 en 19%, en Jisc schatte dat 1% valse positieven op instellingsschaal alsnog ongeveer 4.800 onterechte markeringen per jaar oplevert. Gedragssignalen plus menselijke beoordeling zijn de verdedigbare bewijsstandaard.

Hoe maak je een assessment bestendig tegen ChatGPT?

Vraag om procesbewijs in plaats van alleen antwoorden, begrens de tijd per item, laat scenario's vertakken zodat de volgende vraag afhangt van het vorige antwoord, gebruik minimaal drie parallelle varianten per scenario en combineer formats, bijvoorbeeld een forced-choice SJT, een cognitieve game met tijdslimiet en een korte video-opdracht in één flow.

Mag je kandidaten monitoren op AI-gebruik onder de AVG en de EU AI Act?

Ja, onder voorwaarden. Toestemming moet expliciet en per gegevenstype (camera, audio, scherm) worden gegeven, bewaartermijnen moeten vastliggen en minimaal zijn, en geen enkel negatief besluit mag uitsluitend op een automatische vlag rusten. Een mens beoordeelt elke gemarkeerde sessie voordat er een besluit valt.