Je beoordeelt assessmentaanbieders met een weegmodel door criteria te groeperen in drie blokken, assessmentkwaliteit, operationele integratie en governance, elk blok een gewicht te geven dat past bij het rolniveau, en iedere aanbieder per criterium een score van 1 tot 5 te geven. Het gewogen totaal maakt je keuze uitlegbaar en herhaalbaar.
De meeste selectietrajecten voor een assessmentaanbieder lopen al mis voordat ze beginnen. HR-teams vergelijken aanbieders op onderbuikgevoel, demo-indruk en prijs, terwijl de criteria die wervingsresultaat werkelijk voorspellen buiten beeld blijven. Denk aan voorspellende validiteit, de diepte van de ATS-integratie, data over adverse impact en privacygovernance. Het resultaat is een besluit dat je niet kunt verdedigen bij legal, niet kunt uitleggen aan hiring managers en volgende ronde niet kunt verbeteren.
Deze gids geeft je een herhaalbaar, numeriek weegmodel. Je gaat weg met een heldere criterialijst, drie wegingssjablonen per rolniveau, een uitgewerkt rekenvoorbeeld en een opzet voor een scorecard die je in Excel bouwt of als CSV importeert. Eenmalig voor één traject, of als standaard voor je hele TA-functie.
Wat je nodig hebt voordat je begint
Niveau gevorderd. Tijd 2 tot 3 uur voor de eerste opzet, daarna 1 uur per aanbieder.
Groepeer je criteria in drie blokken. Dat houdt het model controleerbaar en voorkomt dat één dimensie, meestal prijs, het besluit domineert.
Hier beginnen de meeste verkooppraatjes, en hier stoppen de meeste beoordelaars te vroeg.
Voorspellende validiteit. Vraag om criteriumgerelateerde validatiestudies voor precies de functiefamilie waarvoor je werft. Een generieke studie over "salesrollen" is niet genoeg als je B2B enterprise sales in een gereguleerde sector zoekt. Goed bewijs bestaat uit gepubliceerde of eigen validatiestudies met steekproeven boven de 100, effectgroottes in de vorm van correlatiecoëfficiënten en een transparante methode. Alarmbel als een aanbieder "toonaangevende validiteit" claimt zonder een technische handleiding te delen.
Betrouwbaarheid. Vraag naar interne consistentie (Cronbach's alfa) en waar relevant test-hertestbetrouwbaarheid. Scores moeten stabiel genoeg zijn dat een kandidaat die de test opnieuw maakt onder normale omstandigheden een vergelijkbaar resultaat haalt.
Eerlijkheid en adverse impact. Volgens de richtlijn van de Amerikaanse EEOC (Questions and Answers, 1 maart 1979) is er normaal gesproken sprake van adverse impact als het selectiepercentage van de ene groep lager is dan 80% van dat van een andere groep, de zogeheten 4/5-regel. Dat is Amerikaanse richtlijn, geen Nederlandse wet, maar het is een bruikbare drempel om aan aanbieders voor te leggen. Vraag rechtstreeks of ze selectiepercentages per demografische groep monitoren en of ze data hebben over differentiële item functioning (DIF). Dit is basale due diligence, geen juridisch advies.
Relevantie van de normgroep. Een intelligentietest die genormeerd is op universitair geschoolden past niet bij werving op volume in logistiek of productie. Check of de normgroep aansluit op jouw kandidaatpopulatie qua opleidingsniveau, sector en land.
Maatwerk en rolspecificiteit. Kan de aanbieder per functiefamilie een andere combinatie van onderdelen inrichten? Modulair assessmentontwerp, waarbij je per rol cognitieve, persoonlijkheids- en vaardigheidsonderdelen kiest, is een echt verschil voor organisaties die over meerdere functies heen werven.
Assessmentkwaliteit die nooit gebruikt wordt omdat de workflow schuurt, is in de praktijk waardeloos.
Diepte van de ATS-integratie. "Integratie" kan alles betekenen, van een webhook die een link verstuurt tot volledige tweerichtingssynchronisatie waarbij uitnodigingen automatisch uitgaan, resultaten in het ATS-scherm van de recruiter staan en rapporten zonder handwerk aan het kandidaatprofiel hangen. Vraag om een live demo van de koppeling met jouw specifieke ATS. Goed bewijs is een end-to-end demo, een referentieklant op hetzelfde ATS en een gedocumenteerde integratiescope. Alarmbel bij koppelingen die handmatige CSV-exports vragen.
Kandidaatervaring en drop-off. Frictie bij plannen en trage reactietijden werken direct door in je acceptatiegraad en time-to-hire. Vraag aanbieders om data over completion rate en gemiddelde doorlooptijd. Platforms met mobile-native of WhatsApp-intake die binnen seconden reageren verlagen drop-off merkbaar. Als referentiepunt, SmartChat van Selection Lab rapporteert 27% minder drop-offs en 15 minuten tijdwinst per recruiter per sollicitant, wat laat zien wat geoptimaliseerde intake-automatisering kan opleveren.
Implementatietijd en verandermanagement. Hoe lang duurt livegang realistisch? Wat levert de aanbieder aan onboarding, training en ondersteuning voor recruiters? Korte doorlooptijd weegt zwaarder bij programma's op volume, waar je geen zes weken vertraging kunt gebruiken.
Analytics en rapportage. Kun je funnelconversie per assessmentstap volgen? Kun je data exporteren voor eigen analyse? Rapportage die alleen in het dashboard van de aanbieder bestaat, maakt je afhankelijk. Rapportage in het ATS, waarbij recruiters resultaten zien zonder van tool te wisselen, verhoogt het gebruik.
Vaak afgedaan als juridisch vinkje, maar voor Europese organisaties en elk team dat met gevoelige kandidaatdata werkt is dit blok een harde afvaller.
AVG en geautomatiseerde besluitvorming. Artikel 22 AVG geeft betrokkenen het recht niet te worden onderworpen aan een besluit dat uitsluitend op geautomatiseerde verwerking berust en aanmerkelijke gevolgen heeft, met een aantal uitzonderingen. Gebruik je geautomatiseerde screeningsscores om kandidaten door te laten of af te wijzen zonder menselijke tussenkomst, dan heb je vastgelegde waarborgen nodig. Een reviewstap met een mens erin, informatie aan de kandidaat en de mogelijkheid om uitleg te vragen of het besluit te betwisten. Vraag aanbieders om hun documentatie hierover.
Dataopslag en beveiliging. Waar staat kandidaatdata? Is er een verwerkersovereenkomst? Zijn bewaar- en verwijdertermijnen instelbaar? Voor Europese werving is opslag binnen de EU, bijvoorbeeld infrastructuur in Frankfurt, een reëel inkoopcriterium. Vraag ook of de aanbieder AI-modellen van derden gebruikt die persoonsgegevens naar buiten sturen, of lokale of private modellen die de datablootstelling beperken.
Auditbaarheid. Kun je aantonen welke kandidaten zijn beoordeeld, welke versie van het assessment is gebruikt, welke scores eruit kwamen en welke besluiten volgden? Dat is relevant voor interne audits én voor elke vraag van een toezichthouder.
Service levels. Welke uptime garandeert de aanbieder? Wat is de escalatieroute bij technische storing tijdens een lopende campagne? Ontbrekende SLA's zijn een klassieke blinde vlek die pas opvalt op het slechtst mogelijke moment.
Wegingen horen het risico- en volumeprofiel van de rol te volgen. Hieronder drie startsjablonen. Alle wegingen tellen op tot 100%.
| Criteriablok | Instap en volume | Medior professional | Senior en management |
|---|---|---|---|
| Assessmentkwaliteit en bewijs | 25% | 35% | 40% |
| Operationele werking en data-integratie | 45% | 30% | 20% |
| Vertrouwen en governance | 20% | 25% | 30% |
| Commercieel en SLA's | 10% | 10% | 10% |
Bij instaprollen op volume, denk aan logistiek, retail en klantcontact, wegen automatisering en kandidaatervaring zwaarder, omdat recruitercapaciteit en drop-off direct de doorstroom bepalen. Assessmentbewijs blijft belangrijk, maar een aanbieder die niet schoon koppelt met je ATS of 40% van je kandidaten kwijtraakt voor de finish, levert geen gevalideerde werving op, hoe goed de test ook is.
Bij senior- en managementrollen is de financiële schade van een misser groter, is de toezichtdruk hoger en weegt de diepte van het assessmentbewijs sterker. Selectiepercentages, validatiestudies en monitoring op adverse impact schuiven dan naar voren.
Koppel je eigen KPI's aan deze blokken voordat je de wegingen vastzet. Is vroeg verloop je grootste probleem, weeg assessmentkwaliteit dan hoger. Is time-to-fill de bottleneck, weeg integratie en kandidaatervaring hoger.
Loop deze checklist door met HR, legal en de betrokken hiring manager voordat je de wegingen vastzet.
Uitgaande van het sjabloon voor medior professional, met per criterium een score van 1 tot 5 (1 is voldoet niet, 5 is voldoet volledig).
| Criterium | Weging | Score A | Gewogen A | Score B | Gewogen B |
|---|---|---|---|---|---|
| Bewijs voor voorspellende validiteit | 15% | 4 | 0,60 | 2 | 0,30 |
| Betrouwbaarheidsdata beschikbaar | 10% | 4 | 0,40 | 3 | 0,30 |
| Data over adverse impact en fairness | 10% | 3 | 0,30 | 2 | 0,20 |
| Diepte van de ATS-integratie | 15% | 5 | 0,75 | 2 | 0,30 |
| Kandidaatervaring en completion rate | 15% | 4 | 0,60 | 3 | 0,45 |
| Analytics en rapportage | 10% | 4 | 0,40 | 3 | 0,30 |
| Privacy en datagovernance | 15% | 5 | 0,75 | 2 | 0,30 |
| SLA's en commerciële voorwaarden | 10% | 3 | 0,30 | 4 | 0,40 |
| Totaal | 100% | 4,10 / 5,00 | 2,55 / 5,00 |
Aanbieder A wint op assessmentkwaliteit, integratie en governance. Aanbieder B scoort hoger op commerciële voorwaarden en lager op vrijwel alles wat wervingsresultaat voorspelt. Had B een 1 gestaan op privacygovernance, dus geen verwerkersovereenkomst, dan valt B af ongeacht het totaal.
Gebruik het totaal als startpunt en niet als eindoordeel. Een aanbieder met 3,8 en een SLA-gat waarover je kunt onderhandelen is een ander gesprek dan een aanbieder met 3,8 en openstaande vragen over fairness-data.
Bouw het bestand met vier tabbladen.
Kalibratie is het verschil tussen een scorecard en een meningenlijst. Scoren drie mensen onafhankelijk, houd dan eerst een kalibratiesessie waarin je één criterium samen scoort en afstemt hoe een 3 zich verhoudt tot een 4 voor dat specifieke criterium. Leg die afspraak vast in de notitiekolom.
Scoor drie tot vijf aanbieders als je longlist dat toelaat. Minder dan drie geeft te weinig vergelijkingsmateriaal. Meer dan vijf is de moeite zelden waard, tenzij je een formele tender doet.
Zet onderaan het wegingstabblad een changelog. Verandert je wervingsprofiel, door een nieuw ATS, een ander volume of nieuwe regelgeving, leg dan de datum vast, wat er veranderde en waarom. Zo blijft de scorecard een levend inkoopinstrument in plaats van een eenmalige oefening.
Het doel is niet een perfecte score. Het doel is een onderbouwd besluit waar je achter kunt staan als een hiring manager vraagt waarom je voor deze aanbieder koos, of als legal vraagt hoe je hebt geborgd dat het proces eerlijk was.
Drie blokken. Assessmentkwaliteit, dus voorspellende validiteit, betrouwbaarheid, normgroep en fairness-data. Operationele werking, dus diepte van de ATS-integratie, kandidaatervaring, implementatietijd en rapportage. En governance, dus AVG en artikel 22, dataopslag, auditbaarheid en SLA's. Prijs hoort in een vierde, licht gewogen blok, zodat het je besluit niet overneemt.
Drie tot vijf. Minder dan drie geeft te weinig vergelijkingsmateriaal om een score te kunnen plaatsen. Meer dan vijf kost meer beoordelingstijd dan het oplevert, tenzij je een formele tender doorloopt waarin dat verplicht is.
Een vuistregel uit de Amerikaanse EEOC-richtlijn (Questions and Answers, 1 maart 1979). Er is normaal gesproken sprake van adverse impact als het selectiepercentage van de ene groep lager is dan 80% van dat van een andere groep. Het is geen Nederlandse wet, maar wel een bruikbare drempel om aan aanbieders voor te leggen naast hun DIF-data.
Niet uitsluitend geautomatiseerd. Artikel 22 AVG geeft betrokkenen het recht niet te worden onderworpen aan een besluit dat alleen op geautomatiseerde verwerking berust en aanmerkelijke gevolgen heeft, met een aantal uitzonderingen. In de praktijk betekent dat een reviewstap met een mens erin, informatie aan de kandidaat en een route om uitleg te vragen of het besluit te betwisten. Dit is geen juridisch advies, leg je eigen inrichting voor aan legal.
Leg het zwaartepunt bij operationele werking. Een werkbaar startpunt is 45% operationele werking en data-integratie, 25% assessmentkwaliteit, 20% governance en 10% commercieel. Bij instaprollen bepalen recruitercapaciteit en drop-off de doorstroom, dus een aanbieder die niet schoon koppelt of kandidaten kwijtraakt levert geen resultaat, hoe goed de test ook is.
Wil je verder lezen? Bekijk onze top 20 assessmentaanbieders in Nederland of hoe recruitment AI in een selectieflow past.

Je beoordeelt assessmentaanbieders met een weegmodel door criteria te groeperen in drie blokken, assessmentkwaliteit, operationele integratie en governance, elk blok een gewicht te geven dat past bij het rolniveau, en iedere aanbieder per criterium een score van 1 tot 5 te geven. Het gewogen totaal maakt je keuze uitlegbaar en herhaalbaar.
De meeste selectietrajecten voor een assessmentaanbieder lopen al mis voordat ze beginnen. HR-teams vergelijken aanbieders op onderbuikgevoel, demo-indruk en prijs, terwijl de criteria die wervingsresultaat werkelijk voorspellen buiten beeld blijven. Denk aan voorspellende validiteit, de diepte van de ATS-integratie, data over adverse impact en privacygovernance. Het resultaat is een besluit dat je niet kunt verdedigen bij legal, niet kunt uitleggen aan hiring managers en volgende ronde niet kunt verbeteren.
Deze gids geeft je een herhaalbaar, numeriek weegmodel. Je gaat weg met een heldere criterialijst, drie wegingssjablonen per rolniveau, een uitgewerkt rekenvoorbeeld en een opzet voor een scorecard die je in Excel bouwt of als CSV importeert. Eenmalig voor één traject, of als standaard voor je hele TA-functie.
Wat je nodig hebt voordat je begint
Niveau gevorderd. Tijd 2 tot 3 uur voor de eerste opzet, daarna 1 uur per aanbieder.
Groepeer je criteria in drie blokken. Dat houdt het model controleerbaar en voorkomt dat één dimensie, meestal prijs, het besluit domineert.
Hier beginnen de meeste verkooppraatjes, en hier stoppen de meeste beoordelaars te vroeg.
Voorspellende validiteit. Vraag om criteriumgerelateerde validatiestudies voor precies de functiefamilie waarvoor je werft. Een generieke studie over "salesrollen" is niet genoeg als je B2B enterprise sales in een gereguleerde sector zoekt. Goed bewijs bestaat uit gepubliceerde of eigen validatiestudies met steekproeven boven de 100, effectgroottes in de vorm van correlatiecoëfficiënten en een transparante methode. Alarmbel als een aanbieder "toonaangevende validiteit" claimt zonder een technische handleiding te delen.
Betrouwbaarheid. Vraag naar interne consistentie (Cronbach's alfa) en waar relevant test-hertestbetrouwbaarheid. Scores moeten stabiel genoeg zijn dat een kandidaat die de test opnieuw maakt onder normale omstandigheden een vergelijkbaar resultaat haalt.
Eerlijkheid en adverse impact. Volgens de richtlijn van de Amerikaanse EEOC (Questions and Answers, 1 maart 1979) is er normaal gesproken sprake van adverse impact als het selectiepercentage van de ene groep lager is dan 80% van dat van een andere groep, de zogeheten 4/5-regel. Dat is Amerikaanse richtlijn, geen Nederlandse wet, maar het is een bruikbare drempel om aan aanbieders voor te leggen. Vraag rechtstreeks of ze selectiepercentages per demografische groep monitoren en of ze data hebben over differentiële item functioning (DIF). Dit is basale due diligence, geen juridisch advies.
Relevantie van de normgroep. Een intelligentietest die genormeerd is op universitair geschoolden past niet bij werving op volume in logistiek of productie. Check of de normgroep aansluit op jouw kandidaatpopulatie qua opleidingsniveau, sector en land.
Maatwerk en rolspecificiteit. Kan de aanbieder per functiefamilie een andere combinatie van onderdelen inrichten? Modulair assessmentontwerp, waarbij je per rol cognitieve, persoonlijkheids- en vaardigheidsonderdelen kiest, is een echt verschil voor organisaties die over meerdere functies heen werven.
Assessmentkwaliteit die nooit gebruikt wordt omdat de workflow schuurt, is in de praktijk waardeloos.
Diepte van de ATS-integratie. "Integratie" kan alles betekenen, van een webhook die een link verstuurt tot volledige tweerichtingssynchronisatie waarbij uitnodigingen automatisch uitgaan, resultaten in het ATS-scherm van de recruiter staan en rapporten zonder handwerk aan het kandidaatprofiel hangen. Vraag om een live demo van de koppeling met jouw specifieke ATS. Goed bewijs is een end-to-end demo, een referentieklant op hetzelfde ATS en een gedocumenteerde integratiescope. Alarmbel bij koppelingen die handmatige CSV-exports vragen.
Kandidaatervaring en drop-off. Frictie bij plannen en trage reactietijden werken direct door in je acceptatiegraad en time-to-hire. Vraag aanbieders om data over completion rate en gemiddelde doorlooptijd. Platforms met mobile-native of WhatsApp-intake die binnen seconden reageren verlagen drop-off merkbaar. Als referentiepunt, SmartChat van Selection Lab rapporteert 27% minder drop-offs en 15 minuten tijdwinst per recruiter per sollicitant, wat laat zien wat geoptimaliseerde intake-automatisering kan opleveren.
Implementatietijd en verandermanagement. Hoe lang duurt livegang realistisch? Wat levert de aanbieder aan onboarding, training en ondersteuning voor recruiters? Korte doorlooptijd weegt zwaarder bij programma's op volume, waar je geen zes weken vertraging kunt gebruiken.
Analytics en rapportage. Kun je funnelconversie per assessmentstap volgen? Kun je data exporteren voor eigen analyse? Rapportage die alleen in het dashboard van de aanbieder bestaat, maakt je afhankelijk. Rapportage in het ATS, waarbij recruiters resultaten zien zonder van tool te wisselen, verhoogt het gebruik.
Vaak afgedaan als juridisch vinkje, maar voor Europese organisaties en elk team dat met gevoelige kandidaatdata werkt is dit blok een harde afvaller.
AVG en geautomatiseerde besluitvorming. Artikel 22 AVG geeft betrokkenen het recht niet te worden onderworpen aan een besluit dat uitsluitend op geautomatiseerde verwerking berust en aanmerkelijke gevolgen heeft, met een aantal uitzonderingen. Gebruik je geautomatiseerde screeningsscores om kandidaten door te laten of af te wijzen zonder menselijke tussenkomst, dan heb je vastgelegde waarborgen nodig. Een reviewstap met een mens erin, informatie aan de kandidaat en de mogelijkheid om uitleg te vragen of het besluit te betwisten. Vraag aanbieders om hun documentatie hierover.
Dataopslag en beveiliging. Waar staat kandidaatdata? Is er een verwerkersovereenkomst? Zijn bewaar- en verwijdertermijnen instelbaar? Voor Europese werving is opslag binnen de EU, bijvoorbeeld infrastructuur in Frankfurt, een reëel inkoopcriterium. Vraag ook of de aanbieder AI-modellen van derden gebruikt die persoonsgegevens naar buiten sturen, of lokale of private modellen die de datablootstelling beperken.
Auditbaarheid. Kun je aantonen welke kandidaten zijn beoordeeld, welke versie van het assessment is gebruikt, welke scores eruit kwamen en welke besluiten volgden? Dat is relevant voor interne audits én voor elke vraag van een toezichthouder.
Service levels. Welke uptime garandeert de aanbieder? Wat is de escalatieroute bij technische storing tijdens een lopende campagne? Ontbrekende SLA's zijn een klassieke blinde vlek die pas opvalt op het slechtst mogelijke moment.
Wegingen horen het risico- en volumeprofiel van de rol te volgen. Hieronder drie startsjablonen. Alle wegingen tellen op tot 100%.
| Criteriablok | Instap en volume | Medior professional | Senior en management |
|---|---|---|---|
| Assessmentkwaliteit en bewijs | 25% | 35% | 40% |
| Operationele werking en data-integratie | 45% | 30% | 20% |
| Vertrouwen en governance | 20% | 25% | 30% |
| Commercieel en SLA's | 10% | 10% | 10% |
Bij instaprollen op volume, denk aan logistiek, retail en klantcontact, wegen automatisering en kandidaatervaring zwaarder, omdat recruitercapaciteit en drop-off direct de doorstroom bepalen. Assessmentbewijs blijft belangrijk, maar een aanbieder die niet schoon koppelt met je ATS of 40% van je kandidaten kwijtraakt voor de finish, levert geen gevalideerde werving op, hoe goed de test ook is.
Bij senior- en managementrollen is de financiële schade van een misser groter, is de toezichtdruk hoger en weegt de diepte van het assessmentbewijs sterker. Selectiepercentages, validatiestudies en monitoring op adverse impact schuiven dan naar voren.
Koppel je eigen KPI's aan deze blokken voordat je de wegingen vastzet. Is vroeg verloop je grootste probleem, weeg assessmentkwaliteit dan hoger. Is time-to-fill de bottleneck, weeg integratie en kandidaatervaring hoger.
Loop deze checklist door met HR, legal en de betrokken hiring manager voordat je de wegingen vastzet.
Uitgaande van het sjabloon voor medior professional, met per criterium een score van 1 tot 5 (1 is voldoet niet, 5 is voldoet volledig).
| Criterium | Weging | Score A | Gewogen A | Score B | Gewogen B |
|---|---|---|---|---|---|
| Bewijs voor voorspellende validiteit | 15% | 4 | 0,60 | 2 | 0,30 |
| Betrouwbaarheidsdata beschikbaar | 10% | 4 | 0,40 | 3 | 0,30 |
| Data over adverse impact en fairness | 10% | 3 | 0,30 | 2 | 0,20 |
| Diepte van de ATS-integratie | 15% | 5 | 0,75 | 2 | 0,30 |
| Kandidaatervaring en completion rate | 15% | 4 | 0,60 | 3 | 0,45 |
| Analytics en rapportage | 10% | 4 | 0,40 | 3 | 0,30 |
| Privacy en datagovernance | 15% | 5 | 0,75 | 2 | 0,30 |
| SLA's en commerciële voorwaarden | 10% | 3 | 0,30 | 4 | 0,40 |
| Totaal | 100% | 4,10 / 5,00 | 2,55 / 5,00 |
Aanbieder A wint op assessmentkwaliteit, integratie en governance. Aanbieder B scoort hoger op commerciële voorwaarden en lager op vrijwel alles wat wervingsresultaat voorspelt. Had B een 1 gestaan op privacygovernance, dus geen verwerkersovereenkomst, dan valt B af ongeacht het totaal.
Gebruik het totaal als startpunt en niet als eindoordeel. Een aanbieder met 3,8 en een SLA-gat waarover je kunt onderhandelen is een ander gesprek dan een aanbieder met 3,8 en openstaande vragen over fairness-data.
Bouw het bestand met vier tabbladen.
Kalibratie is het verschil tussen een scorecard en een meningenlijst. Scoren drie mensen onafhankelijk, houd dan eerst een kalibratiesessie waarin je één criterium samen scoort en afstemt hoe een 3 zich verhoudt tot een 4 voor dat specifieke criterium. Leg die afspraak vast in de notitiekolom.
Scoor drie tot vijf aanbieders als je longlist dat toelaat. Minder dan drie geeft te weinig vergelijkingsmateriaal. Meer dan vijf is de moeite zelden waard, tenzij je een formele tender doet.
Zet onderaan het wegingstabblad een changelog. Verandert je wervingsprofiel, door een nieuw ATS, een ander volume of nieuwe regelgeving, leg dan de datum vast, wat er veranderde en waarom. Zo blijft de scorecard een levend inkoopinstrument in plaats van een eenmalige oefening.
Het doel is niet een perfecte score. Het doel is een onderbouwd besluit waar je achter kunt staan als een hiring manager vraagt waarom je voor deze aanbieder koos, of als legal vraagt hoe je hebt geborgd dat het proces eerlijk was.
Drie blokken. Assessmentkwaliteit, dus voorspellende validiteit, betrouwbaarheid, normgroep en fairness-data. Operationele werking, dus diepte van de ATS-integratie, kandidaatervaring, implementatietijd en rapportage. En governance, dus AVG en artikel 22, dataopslag, auditbaarheid en SLA's. Prijs hoort in een vierde, licht gewogen blok, zodat het je besluit niet overneemt.
Drie tot vijf. Minder dan drie geeft te weinig vergelijkingsmateriaal om een score te kunnen plaatsen. Meer dan vijf kost meer beoordelingstijd dan het oplevert, tenzij je een formele tender doorloopt waarin dat verplicht is.
Een vuistregel uit de Amerikaanse EEOC-richtlijn (Questions and Answers, 1 maart 1979). Er is normaal gesproken sprake van adverse impact als het selectiepercentage van de ene groep lager is dan 80% van dat van een andere groep. Het is geen Nederlandse wet, maar wel een bruikbare drempel om aan aanbieders voor te leggen naast hun DIF-data.
Niet uitsluitend geautomatiseerd. Artikel 22 AVG geeft betrokkenen het recht niet te worden onderworpen aan een besluit dat alleen op geautomatiseerde verwerking berust en aanmerkelijke gevolgen heeft, met een aantal uitzonderingen. In de praktijk betekent dat een reviewstap met een mens erin, informatie aan de kandidaat en een route om uitleg te vragen of het besluit te betwisten. Dit is geen juridisch advies, leg je eigen inrichting voor aan legal.
Leg het zwaartepunt bij operationele werking. Een werkbaar startpunt is 45% operationele werking en data-integratie, 25% assessmentkwaliteit, 20% governance en 10% commercieel. Bij instaprollen bepalen recruitercapaciteit en drop-off de doorstroom, dus een aanbieder die niet schoon koppelt of kandidaten kwijtraakt levert geen resultaat, hoe goed de test ook is.
Wil je verder lezen? Bekijk onze top 20 assessmentaanbieders in Nederland of hoe recruitment AI in een selectieflow past.