Spring til indhold
NYT WEBSITE LANCERET i DAGVi er i fuld gang med finpudsning og fejlretning :-)
Lykke og Co.
70 22 71 12

Vidensbank · DISC & personprofiler

Testretfærdighed, måleinvarians og adverse impact

Kort fortalt

Testretfærdighed er et bredt krav om, at måling og brug er saglig, tilgængelig og fri for irrelevant skævhed. Måleinvarians undersøger, om konstrukter og scores fungerer sammenligneligt på tværs af grupper. Adverse impact er en udfaldsforskel og er ikke i sig selv det samme som målebias.

Hvad er testretfærdighed?

Fairness omfatter design, adgang, administration, scorefortolkning, beslutningsregler og konsekvenser. En test kan måle samme konstrukt på tværs af grupper og stadig indgå i en uretfærdig proces.

Testretfærdighed bliver mest præcist, når begrebet kobles til konstrukt, instrument, population, administration, score og beslutningsformål. Det gør det muligt at skelne mellem en faglig definition, en praktisk model og en løs hverdagsetiket. Skellet er vigtigt, fordi de tre former ikke kan bære de samme konklusioner eller beslutninger.

Vigtige afgrænsninger

  • Målebias er systematisk construct-irrelevant forskel i scores.
  • Måleinvarians er statistisk sammenlignelighed på flere niveauer.
  • Adverse impact beskriver forskelle i udvælgelsesrater og kræver videre undersøgelse.

Afgrænsningerne omkring testretfærdighed er ikke kun sproglige. De bestemmer, hvilke data der er relevante, hvilke fejl man risikerer, og om en anbefaling kan forsvares. Start derfor med at skrive, hvad begrebet omfatter og ikke omfatter i den konkrete brug.

Hvad viser forskningen?

Faglige standarder gør fairness til en grunddimension ved siden af validitet og reliabilitet.

Metodereviews viser, at gruppesammenligninger kræver passende invarians og gennemtænkt gruppekategorisering.

Fairness kan ikke afgøres af én statistisk test alene.

Kilderne om testretfærdighed viser et samlet mønster, men de er ikke et løfte om et bestemt resultat hos en bestemt person eller arbejdsplads. Studier varierer i population, design, måling og kontekst. Korrelationer kan støtte en faglig hypotese, men fastslår ikke alene årsag og virkning.

Sådan kan testretfærdighed bruges ansvarligt

  1. Definér jobrelevant konstrukt og mulige barrierer.
  2. Test målefunktion og tilgængelighed i relevante grupper.
  3. Monitorér udfald og undersøg alternative forklaringer.
  4. Justér proces, indhold eller kombination af metoder, når risikoen ikke kan forsvares.

Skriv først hvilket konstrukt og hvilken beslutning testretfærdighed skal understøtte. Kontrollér instrument, normer, usikkerhed og dokumentation, og beslut på forhånd hvordan resultatet kombineres med andre data og forklares for den berørte person.

Begrænsninger og typiske fejl

  • Kald ikke enhver gruppeskel diskrimination eller enhver valid test fair.
  • Brug ikke små undergrupper til sikre konklusioner.
  • Skjul ikke adverse impact bag en samlet validitet.

Ved brug af testretfærdighed er den vigtigste kildekritiske regel proportionalitet. Jo større konsekvens en fortolkning får for mennesker, desto stærkere og mere lokal dokumentation kræves. En model kan være god til refleksion uden at være egnet til udvælgelse, diagnose eller juridiske konklusioner.

Måling og opfølgning

Ved måling af testretfærdighed: Dokumentér scoredefinition, måleusikkerhed, normgruppe og den præcise beslutning. Undersøg reliabilitet, validitet og fairness for den konkrete brug. Små forskelle omkring en tærskel bør behandles som usikre og suppleres med andre relevante data.

For testretfærdighed skal det på forhånd beskrives, hvad der tæller som forbedring, hvilken periode der er relevant, og hvem der kan korrigere fortolkningen. Hvis målet ændres efter resultaterne er set, bliver evalueringen let en efterrationalisering. Brug hellere få tydelige indikatorer end et stort dashboard uden beslutningsværdi.

Kort FAQ

Hvad betyder en score på testretfærdighed?

En score har kun mening i forhold til en defineret skala, administration, norm eller reference og et bestemt formål. Den indeholder måleusikkerhed og må ikke fortolkes som en fuldstændig eller uforanderlig beskrivelse af personen.

Kan resultatet bruges alene?

Nej ved beslutninger med konsekvenser. Brug kun testretfærdighed til et formål, dokumentationen understøtter, og kombiner resultatet med andre jobrelevante eller fagligt relevante data.

Hvilken dokumentation bør man bede om?

Bed om manual, konstruktsdefinition, reliabilitet, validitet, normgrundlag, fairness-analyser, versionsnummer og kompetencekrav. Markedsføring eller en generel henvisning til forskning er ikke det samme som lokal dokumentation.

Fra score til forsvarlig fortolkning

En fortolkning af testretfærdighed skal forbinde konstrukt, instrument, administration, referencegrundlag og beslutningsformål. Skriv også hvilken usikkerhed og hvilke alternative forklaringer der findes. Flere decimaler eller farvekategorier gør ikke målingen mere præcis.

Kontrollér dokumentationen for den aktuelle version og population. En generel forskningsartikel om et konstrukt validerer ikke automatisk et bestemt kommercielt instrument eller dets anvendelse i en konkret beslutning.

Implementering trin for trin

Trin 1: Definér jobrelevant konstrukt og mulige barrierer

Dokumentér trinnet: Definér jobrelevant konstrukt og mulige barrierer. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Trin 2: Test målefunktion og tilgængelighed i relevante grupper

Dokumentér trinnet: Test målefunktion og tilgængelighed i relevante grupper. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Trin 3: Monitorér udfald og undersøg alternative forklaringer

Dokumentér trinnet: Monitorér udfald og undersøg alternative forklaringer. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Trin 4: Justér proces, indhold eller kombination af metoder, når risikoen ikke kan forsvares

Dokumentér trinnet: Justér proces, indhold eller kombination af metoder, når risikoen ikke kan forsvares. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.

Kvalitetssikring før brug

Kontrollér at definition, kilder, anbefalinger og den konkrete anvendelse af testretfærdighed passer sammen. En kilde om gennemsnitlige sammenhænge kan ikke alene begrunde en individuel beslutning, og en teori om en mekanisme dokumenterer ikke automatisk effekten af et bestemt produkt.

Ved arbejde med testretfærdighed skal mindst ét perspektiv kunne udfordre den foretrukne forklaring, og berørte personer skal kunne korrigere faktuelle fejl. Ved høj konsekvens skal kontrol og dokumentation være tilsvarende stærkere.

Dokumentation og beslutningsspor

For testretfærdighed noteres formål, datakilder, ansvarlig, beslutningsregel, begrænsninger og dato for genbesøg. Beskriv også hvad der ikke blev målt, og hvilke personer eller situationer datagrundlaget dækker dårligt.

Ved gentagen brug af testretfærdighed skal versioner og ændringer kunne spores. Nye spørgsmål, systemer, normer eller målgrupper kan ændre fortolkningen, så en tidligere godkendelse må ikke behandles som permanent tilladelse til enhver anvendelse.

Spørgsmål til faglig gennemgang

  • Hvilken præcis definition af testretfærdighed bruger vi?
  • Hvilken beslutning eller adfærd skal begrebet forbedre?
  • Hvilken kilde er stærkest, og hvad kan den ikke dokumentere?
  • Hvilke alternative forklaringer er realistiske?
  • Hvem bærer risikoen ved en forkert fortolkning?
  • Hvornår og på hvilket grundlag stopper eller ændrer vi praksis?

Kilder og kildekritik

Kildelisten for testretfærdighed prioriterer faglige standarder, meta-analyser, systematiske reviews og originale modeller. Noterne angiver centrale begrænsninger. Det er vigtigt, fordi en troværdig udgiver eller peer review ikke i sig selv gør enhver praktisk påstand sand.

Relaterede begreber og hjælp i praksis

Læs også Sensitivitet og specificitet i test og screening, Psykometri: Hvordan vurderer man kvaliteten af en test?, Personlighedstest og personprofiler: forskelle og ansvarlig brug.

Lykkeco bruger profiler og test som struktureret beslutnings- eller dialogstøtte inden for det formål, dokumentationen kan bære. Resultater fortolkes med usikkerhed, kontekst og mulighed for spørgsmål, aldrig som hele sandheden om et menneske. Her bliver testretfærdighed altid afgrænset til det formål og den evidens, som den konkrete anvendelse kan bære.

Relaterede begreber

Forløb der arbejder med det

Kilder og videre læsning

Vi bider ikke

Skal vi hjælpe jer på vej?

I behøver ikke vide præcis hvad I skal bruge. Vi hjælper jer med at finde det rigtige - og siger til, hvis noget andet passer bedre.