Vidensbank · DISC & personprofiler
Sensitivitet og specificitet i test og screening
Kort fortalt
Sensitivitet er andelen af reelt positive tilfælde, som en test finder, mens specificitet er andelen af reelt negative tilfælde, som testen korrekt afviser. Begge afhænger af en tærskel og et troværdigt kriterium. De fortæller ikke alene sandsynligheden for, at en persons resultat er korrekt.
Hvad er sensitivitet og specificitet?
Den praktiske fortolkning kræver også base rate eller prævalens samt omkostninger ved falsk positive og falsk negative. I personaleudvælgelse er kriteriet ofte kontinuerligt og fremtidigt, så medicinsk screeningssprog kan blive misvisende.
Sensitivitet og specificitet bliver mest præcist, når begrebet kobles til konstrukt, instrument, population, administration, score og beslutningsformål. Det gør det muligt at skelne mellem en faglig definition, en praktisk model og en løs hverdagsetiket. Skellet er vigtigt, fordi de tre former ikke kan bære de samme konklusioner eller beslutninger.
Vigtige afgrænsninger
- Falsk positiv er en positiv test hos et negativt tilfælde.
- Positiv prædiktiv værdi afhænger af base rate.
- ROC-kurven viser kompromiset mellem sensitivitet og specificitet på tværs af tærskler.
Afgrænsningerne omkring sensitivitet og specificitet er ikke kun sproglige. De bestemmer, hvilke data der er relevante, hvilke fejl man risikerer, og om en anbefaling kan forsvares. Start derfor med at skrive, hvad begrebet omfatter og ikke omfatter i den konkrete brug.
Hvad viser forskningen?
Teststandarder kræver klar definition af kriterium og beslutningsformål.
Høj sensitivitet kan opnås ved at sænke tærsklen, men det øger ofte falsk positive.
Hvis kriteriet selv er usikkert, bliver alle klassifikationer usikre.
Kilderne om sensitivitet og specificitet viser et samlet mønster, men de er ikke et løfte om et bestemt resultat hos en bestemt person eller arbejdsplads. Studier varierer i population, design, måling og kontekst. Korrelationer kan støtte en faglig hypotese, men fastslår ikke alene årsag og virkning.
Sådan kan sensitivitet og specificitet bruges ansvarligt
- Definér måltilstand og referencekriterium.
- Beregn hele forvekslingsmatricen ved relevante tærskler.
- Inddrag base rate og fejlomkostninger.
- Valider tærsklen i nye, sammenlignelige data.
Skriv først hvilket konstrukt og hvilken beslutning sensitivitet og specificitet skal understøtte. Kontrollér instrument, normer, usikkerhed og dokumentation, og beslut på forhånd hvordan resultatet kombineres med andre data og forklares for den berørte person.
Begrænsninger og typiske fejl
- Rapportér ikke sensitivitet uden specificitet og omvendt.
- Brug ikke kliniske ord om almindelige jobscore uden behov.
- Overfør ikke tærskler mellem populationer uden validering.
Ved brug af sensitivitet og specificitet er den vigtigste kildekritiske regel proportionalitet. Jo større konsekvens en fortolkning får for mennesker, desto stærkere og mere lokal dokumentation kræves. En model kan være god til refleksion uden at være egnet til udvælgelse, diagnose eller juridiske konklusioner.
Måling og opfølgning
Ved måling af sensitivitet og specificitet: Dokumentér scoredefinition, måleusikkerhed, normgruppe og den præcise beslutning. Undersøg reliabilitet, validitet og fairness for den konkrete brug. Små forskelle omkring en tærskel bør behandles som usikre og suppleres med andre relevante data.
For sensitivitet og specificitet skal det på forhånd beskrives, hvad der tæller som forbedring, hvilken periode der er relevant, og hvem der kan korrigere fortolkningen. Hvis målet ændres efter resultaterne er set, bliver evalueringen let en efterrationalisering. Brug hellere få tydelige indikatorer end et stort dashboard uden beslutningsværdi.
Kort FAQ
Hvad betyder en score på sensitivitet og specificitet?
En score har kun mening i forhold til en defineret skala, administration, norm eller reference og et bestemt formål. Den indeholder måleusikkerhed og må ikke fortolkes som en fuldstændig eller uforanderlig beskrivelse af personen.
Kan resultatet bruges alene?
Nej ved beslutninger med konsekvenser. Brug kun sensitivitet og specificitet til et formål, dokumentationen understøtter, og kombiner resultatet med andre jobrelevante eller fagligt relevante data.
Hvilken dokumentation bør man bede om?
Bed om manual, konstruktsdefinition, reliabilitet, validitet, normgrundlag, fairness-analyser, versionsnummer og kompetencekrav. Markedsføring eller en generel henvisning til forskning er ikke det samme som lokal dokumentation.
Fra score til forsvarlig fortolkning
En fortolkning af sensitivitet og specificitet skal forbinde konstrukt, instrument, administration, referencegrundlag og beslutningsformål. Skriv også hvilken usikkerhed og hvilke alternative forklaringer der findes. Flere decimaler eller farvekategorier gør ikke målingen mere præcis.
Kontrollér dokumentationen for den aktuelle version og population. En generel forskningsartikel om et konstrukt validerer ikke automatisk et bestemt kommercielt instrument eller dets anvendelse i en konkret beslutning.
Implementering trin for trin
Trin 1: Definér måltilstand og referencekriterium
Dokumentér trinnet: Definér måltilstand og referencekriterium. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Trin 2: Beregn hele forvekslingsmatricen ved relevante tærskler
Dokumentér trinnet: Beregn hele forvekslingsmatricen ved relevante tærskler. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Trin 3: Inddrag base rate og fejlomkostninger
Dokumentér trinnet: Inddrag base rate og fejlomkostninger. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Trin 4: Valider tærsklen i nye, sammenlignelige data
Dokumentér trinnet: Valider tærsklen i nye, sammenlignelige data. Angiv instrumentversion, datagrundlag, fagligt ansvarlig, fortolkningsregel og grænser for anvendelsen. Den berørte person skal kunne stille spørgsmål og korrigere faktuelle fejl.
Kvalitetssikring før brug
Kontrollér at definition, kilder, anbefalinger og den konkrete anvendelse af sensitivitet og specificitet passer sammen. En kilde om gennemsnitlige sammenhænge kan ikke alene begrunde en individuel beslutning, og en teori om en mekanisme dokumenterer ikke automatisk effekten af et bestemt produkt.
Ved arbejde med sensitivitet og specificitet skal mindst ét perspektiv kunne udfordre den foretrukne forklaring, og berørte personer skal kunne korrigere faktuelle fejl. Ved høj konsekvens skal kontrol og dokumentation være tilsvarende stærkere.
Dokumentation og beslutningsspor
For sensitivitet og specificitet noteres formål, datakilder, ansvarlig, beslutningsregel, begrænsninger og dato for genbesøg. Beskriv også hvad der ikke blev målt, og hvilke personer eller situationer datagrundlaget dækker dårligt.
Ved gentagen brug af sensitivitet og specificitet skal versioner og ændringer kunne spores. Nye spørgsmål, systemer, normer eller målgrupper kan ændre fortolkningen, så en tidligere godkendelse må ikke behandles som permanent tilladelse til enhver anvendelse.
Kilder og kildekritik
Kildelisten for sensitivitet og specificitet prioriterer faglige standarder, meta-analyser, systematiske reviews og originale modeller. Noterne angiver centrale begrænsninger. Det er vigtigt, fordi en troværdig udgiver eller peer review ikke i sig selv gør enhver praktisk påstand sand.
Relaterede begreber og hjælp i praksis
Læs også Psykometri: Hvordan vurderer man kvaliteten af en test?, Personlighedstest og personprofiler: forskelle og ansvarlig brug, Big Five og femfaktormodellen.
Lykkeco bruger profiler og test som struktureret beslutnings- eller dialogstøtte inden for det formål, dokumentationen kan bære. Resultater fortolkes med usikkerhed, kontekst og mulighed for spørgsmål, aldrig som hele sandheden om et menneske. Her bliver sensitivitet og specificitet altid afgrænset til det formål og den evidens, som den konkrete anvendelse kan bære.
Relaterede begreber
Forløb der arbejder med det
Kilder og videre læsning
- AERA, APA & NCME, Standards for Educational and Psychological Testing, 2014. Tværfaglig fagstandard for validitet, reliabilitet, fairness, scoring og testbrug. Den er normativ vejledning, ikke et effektstudie af en bestemt test.
- Paul R. Sackett m.fl., Revisiting Meta-Analytic Estimates of Validity in Personnel Selection, 2022. Peer-reviewet revurdering af klassiske validitetsestimater. Viser, at flere ældre korrektioner overvurderede niveauet, selv om rangordningen ofte var stabil.
- Society for Industrial and Organizational Psychology, Principles for the Validation and Use of Personnel Selection Procedures, 2018. Faglige principper for jobanalyse, validering, fairness og dokumentation i udvælgelse. Principperne er vejledning og skal anvendes i den konkrete kontekst.



