Hoe vergelijk je kandidaten eerlijk met verschillende tests?

7 min leestijd

Teamoverleg Tadaah

Je hebt drie sterke kandidaten en een stapel input: een interviewverslag, een praktijkcasus, een persoonlijkheidstest, een referentiecheck en misschien nog een rijtest of capaciteitentest. Iedereen wil “objectief” kiezen, maar in de praktijk ontstaat juist ruis: scores zijn niet vergelijkbaar, managers geven elk onderdeel een andere waarde en het gesprek eindigt alsnog bij gevoel. Eerlijk vergelijken gaat niet om één perfecte test, maar om één consistente meetlat over alle bronnen heen.

Waarom kandidaten eerlijk vergelijken met verschillende tests lastig is

Verschillende tests meten verschillende dingen, op verschillende schalen, met verschillende foutmarges. Een casus laat zien hoe iemand redeneert in jullie context, een capaciteitentest meet algemene cognitieve vaardigheid, en referenties gaan vaak over werkhouding en betrouwbaarheid. Als je die uitkomsten zonder structuur naast elkaar legt, maak je appels-met-perenvergelijkingen.

Daar komt groepsdynamiek bij. De meest overtuigende interviewer, het meest recente gesprek of één opvallend detail (“die kandidaat had zo’n goed verhaal”) kan onbewust zwaarder wegen dan het bewijs. Eerlijk vergelijken vraagt dus om afspraken vóórdat je start, niet tijdens het evalueren.

Wat “eerlijk” in selectie meestal betekent

Eerlijk is niet: iedereen hetzelfde behandelen ongeacht de functie. Eerlijk is: iedereen beoordelen op dezelfde relevante criteria, met dezelfde weging, en met dezelfde manier van scoren. Dat maakt je beslissing beter uitlegbaar aan het team en verdedigbaar richting kandidaten.

  • Gelijke kansen: iedere kandidaat doorloopt dezelfde kernonderdelen.
  • Gelijke meetlat: dezelfde criteria en score-ankers, ongeacht wie interviewt.
  • Gelijke interpretatie: vooraf bepalen wat een “goede” score betekent.
  • Transparantie: kandidaten weten wat je beoordeelt en waarom.

Een praktisch model om verschillende tests vergelijkbaar te maken

Begin niet bij de test, maar bij de functie. Wat moet iemand in de eerste 3 tot 6 maanden laten zien? Vertaal dat naar een beperkt aantal selectiecriteria. Pas daarna kies je welke test of methode per criterium het beste bewijs oplevert.

Meer weten over datagedreven recruitment?
Ontdek hoe AI, doelgroepdata en arbeidsmarktinzichten helpen om de juiste kandidaten aan te trekken. Download onze whitepaper voor praktische inzichten of neem vrijblijvend contact op voor advies dat past bij jouw organisatie.

Stap 1: Maak één set criteria (maximaal 8) die succes voorspelt

Als je meer criteria hebt, ontstaat schijnnauwkeurigheid en gaat het team alsnog sturen op voorkeur. Kies een mix van vakinhoud, werkgedrag en contextfactoren. Voor blue collar, techniek, logistiek of maritiem werk zijn criteria als veiligheid, nauwkeurigheid en probleemoplossing vaak belangrijker dan presentatie.

  • Vakvaardigheid (bijv. storingsanalyse, lassen, orderpicken, key account beheer)
  • Werkgedrag (veiligheid, kwaliteit, eigenaarschap, tempo)
  • Samenwerking (overdracht, afstemming, feedback verwerken)
  • Leerbaarheid (snelheid waarmee iemand beter wordt na instructie)
  • Contextfit (ploegendienst, reisafstand, fysieke belasting, regels)

Stap 2: Koppel per criterium een primaire en secundaire meetbron

Elke bron heeft blinde vlekken. Een interview is sterk voor motivatie en gedrag, zwakker voor daadwerkelijke uitvoering. Een casus is sterk voor denkstappen, zwakker voor samenwerking in het echt. Door per criterium een hoofdbron en back-upbron te kiezen, voorkom je dat één onderdeel alles bepaalt.

Introduceer de tabel als beslisdocument: dit is waarom je meerdere tests gebruikt en hoe ze samen één oordeel vormen.

Criterium Primaire meting Secundaire meting Wat noteer je als bewijs?
Probleemoplossend vermogen Praktijkcasus Gestructureerd interview (STAR) Stappenplan, hypothesen, checks, resultaatgerichtheid
Veiligheidsbewustzijn Casus + doorvraag op incidenten Certificaten/werkervaring Herkennen van risico’s, maatregelen, normbesef
Nauwkeurigheid/kwaliteit Werkproef of foutzoek-opdracht Referentiecheck Controlepunten, foutpreventie, omgaan met druk
Samenwerking Gedragsinterview Referentiecheck Voorbeelden van afstemming, conflict, feedback
Leerbaarheid Mini-opdracht met feedbackmoment Interviewvraag over leren Reflectie, aanpassing, effect na feedback

Stap 3: Normaliseer scores naar één schaal (bijv. 1–5)

Dit is de kern van kandidaten eerlijk vergelijken verschillende tests. Je hoeft niet alles statistisch perfect te maken, maar je moet wel consistent zijn. Vertaal elke test naar dezelfde eindscore-schaal en leg vast hoe je dat doet.

  • Casus: rubric met 1–5 ankers (van “mist kernrisico’s” tot “werkt gestructureerd en checkt aannames”).
  • Interview: score per criterium op basis van bewijs, niet op algemene indruk.
  • Persoonlijkheidsvragenlijst: vertaal niet naar “goed/fout”, maar naar “risico’s en aandachtspunten” met een vaste beslisregel.
  • Referenties: standaard vragen en dezelfde score-ankers (bijv. betrouwbaarheid, samenwerking, tempo).

Vermijd het optellen van ruwe testscores van verschillende instrumenten. Als je toch met testpercentielen werkt, maak dan één conversietabel en gebruik die altijd.

Stap 4: Werk met weging, maar houd het simpel

Weging is nuttig als niet alles even belangrijk is. Te veel rekenwerk zorgt dat teams het model laten vallen en terugvallen op “wie voelt het best”. Kies daarom maximaal drie zwaargewichten en laat de rest gelijk tellen.

  • Voor operator/monteur: veiligheid en probleemoplossing zwaarder dan communicatie.
  • Voor logistiek: nauwkeurigheid en tempo zwaarder dan creativiteit.
  • Voor sales: behoefteanalyse en discipline zwaarder dan charme.

Hoe je bias vermindert bij het combineren van bronnen

Zelfs met een goede scorekaart kan onbewuste voorkeur alsnog binnensluipen. De oplossing zit vaak in procesafspraken: wanneer scoor je, wie ziet welke info wanneer, en hoe bespreek je verschillen. Dit is interviewhygiëne, maar dan over het hele selectieproces.

Laat beoordelaars eerst onafhankelijk scoren

Vraag iedereen om per criterium een score en bewijs te noteren voordat je samenkomt. Zo voorkom je dat één dominante mening het gesprek bepaalt. Het maakt verschillen ook bespreekbaar zonder dat iemand “verliest”.

Bespreek per criterium het bewijs, niet de persoon

Een bruikbare zin in evaluaties is: “Welk concreet bewijs zag je dat jouw score verklaart?” Dat dwingt terug naar waarneming. Zinnen als “ik zie het gewoon niet” leveren zelden een eerlijke vergelijking op.

Behandel tests als input, niet als eindvonnis

Met name persoonlijkheids- en capaciteitentests worden vaak te absoluut gebruikt. Terwijl veel instrumenten bedoeld zijn als gesprekshulp: waar zitten mogelijke risico’s, hoe gaat iemand om met druk, hoe leert iemand? Als je ze als knock-out gebruikt, leg dan uit welke rol dat profiel speelt in deze functie en waarom.

Maak knock-outs vooraf expliciet

Een eerlijke vergelijking wordt onzuiver als je tijdens de ronde nieuwe eisen toevoegt. Leg daarom vooraf vast wat niet-onderhandelbaar is. Denk aan een veiligheidscertificaat, een rijbewijs, een verplichte ploegendienst of een minimumscore op veiligheidsbewustzijn.

Wat je wel en niet moet doen met referenties en testdata

Referenties en testresultaten zijn vaak het minst strak georganiseerd, terwijl ze veel invloed hebben in de laatste fase. Maak het daarom klein en standaard. Twee gerichte referentievragen met vaste score-ankers zijn waardevoller dan een lang gesprek dat vooral bevestigt wat je al dacht.

Standaardiseer je referentiecheck

  • Gebruik dezelfde vragen voor elke kandidaat op dezelfde rol.
  • Vraag om concrete voorbeelden: “Wanneer ging het mis en wat deed de kandidaat toen?”
  • Laat de referent eerst de context schetsen (teamgrootte, type werk, druk).

Let op privacy en bewaartermijnen

Je verzamelt sollicitatiegegevens, testuitslagen en notities. Dat valt onder privacywetgeving en vraagt om een duidelijke grondslag, beveiliging en bewaartermijnen. De Autoriteit Persoonsgegevens geeft praktische uitleg over hoe je met sollicitatiegegevens omgaat, inclusief bewaren en informeren van kandidaten; zie uitleg van de Autoriteit Persoonsgegevens over sollicitatiegegevens.

Een korte checklist voor consistente besluitvorming

Als je morgen al eerlijker wilt vergelijken, zijn dit de snelste ingrepen die het meeste verschil maken. Ze kosten weinig tijd, maar halen veel ruis uit jullie besluit.

  • Maximaal 6–8 criteria, gekoppeld aan succes in de functie.
  • Per criterium: primaire meetmethode en één back-upbron.
  • Alles naar één schaal (1–5) met duidelijke score-ankers.
  • Interviewers scoren onafhankelijk en delen bewijs.
  • Knock-outs vooraf vastleggen (en niet meer wijzigen).
  • Testresultaten: altijd in context interpreteren, niet als losse waarheid.

Wil je dit proces een keer doorlichten voor een specifieke doelgroep (blue collar, sales of maritiem) en het vertalen naar scorecards, casussen en een kandidaat journey met minder uitval? Dan past een datagedreven aanpak zoals FosFor die gebruikt vaak goed. Neem gerust contact op om samen een selectieproces te bouwen dat eerlijker vergelijkt en sneller tot een gedragen beslissing komt.

Wij komen graag in contact

Contact opnemen

Goede mensen zoeken geen vacatures. Download de whitepaper en ontdek hoe je ze tóch bereikt.