Sådan beregner du bedømmelsesgrænser korrekt

Sådan beregner du bedømmelsesgrænser korrekt

En bestået grænse for en prøve, også kaldet en cut score, er det mindste antal point, en testdeltager skal opnå for at blive klassificeret som bestået. Formlen er enkel: mindste beståelsespoint = samlede point × (beståelsesprocent ÷ 100).

Her er den korte version. Hvis en prøve er værd 100 point, og beståelsesprocenten er 60%, skal du opnå 60 point for at bestå. Det er hele beregningen for en ligetil prøve med ét afsnit.

Reelle beståelsesgrænser for prøver bliver mere komplicerede, når man medregner:

  • Vægtede afsnit, der tæller forskelligt mod den endelige karakter
  • Afrundingsregler for scoringer, der havner på en brøk
  • Standardiseringsmetoder, der bruges til at begrunde, hvorfor grænsen er sat, hvor den er
  • Målefejl tæt på cut scoren, der påvirker, hvem der klassificeres som bestået eller dumpet

Resten af denne guide gennemgår hvert af disse punkter med gennemregnede eksempler, som du kan tilpasse til dine egne tal.

Vigtige pointer

En forsvarlig beståelsesgrænse for en prøve kommer fra en dokumenteret metode, ikke en gættet procentsats, og formlen til beregning af de nødvendige råpoint er altid samlede point gange beståelsesprocent divideret med 100.

Punkt Detaljer
Brug kernformlen Mindste beståelsespoint er lig med samlede point ganget med beståelsesprocenten, divideret med 100.
Kend din kontekst 60% er en almindelig baseline for amerikanske bachelorkurser, mens licenseringseksamener ofte kræver 70% til 75%, fastsat via formel standardisering.
Vælg en forsvarlig metode Modificeret Angoff, kontrasterende grupper, grænsegruppe og Hofstee er hver velegnet til forskellige indsatsniveauer og opgavetyper.
Behandl zonen ved cut scoren omhyggeligt Scoringer inden for én standardmålefejl fra grænsen fortjener en gennemgang, ikke en automatisk bestå eller dumpet.
Dokumentér alle beslutninger Panelsammensætning, metodeval og konsekvensdata beskytter beståelsesgrænsen, hvis den nogensinde bliver anfægtet.
Test konsekvent op mod din grænse Talent Approved's Magic Create og sessionsdata hjælper med at opbygge rollespecifikke prøver og gennemgå scoringer tæt på grænsen.

Indholdsfortegnelse

Beregning af beståelseskarakterer: Formel, forudindstillinger og afrunding

Matematikken er den samme uanset de samlede point. Multiplicér det samlede antal med beståelsesprocenten udtrykt som et decimaltal.

  1. Prøve ud af 100 point ved 60%: 100 × 0,60 = 60 point kræves.
  2. Prøve ud af 80 point ved 70%: 80 × 0,70 = 56 point kræves.
  3. Vægtet afsluttende prøve værd 40% af en kursuskarakter: hvis kurset kræver en samlet karakter på 65%, og andre komponenter allerede bidrager med 30 point ud af mulige 60, skal den afsluttende eksamen levere mindst 35 af sine 40 tilgængelige point for at lukke hullet.

Afrunding betyder mere, end folk antager. De fleste institutioner runder op til nærmeste hele point, når en beregning havner på en brøk (59,4 bliver 60), da nedafrunding teknisk set ville sænke den angivne grænse.

En beståelsesscore-beregner kan udføre disse konverteringer øjeblikkeligt, men at kende den underliggende formel betyder, at du aldrig er afhængig af én.

Hvad der tæller som en beståelseskarakter i forskellige sammenhænge

En score på ca. 60% svarer normalt til karakteren 'D' i det amerikanske standardkaraktersystem, og dette niveau betragtes ofte som den mindste beståelsesgrænse på bachelorkurser. Men "at bestå kurset" og "at opfylde programkrav" er ikke altid det samme.

Statistik-callout: En D-niveau score på ca. 60% giver ofte kursuspoint, men mange uddannelsesprogrammer, specialer eller professionelle spor kræver et C (70%) eller højere i forudsætningskurser, før man kan avancere.

Uden for klasseværelset skifter grænselogikken fuldstændigt:

  • Licenserings- og certificeringseksamener befinder sig ofte på 70% til 75%, og tallet er sjældent tilfældigt. Det er typisk bygget op gennem formel standardisering snarere end valgt som et rundt tal.
  • Arbejdsgivere og softwareleverandører sætter skræddersyede beståelsesgrænser pr. rolle, baseret på, hvad "kompetent nok til at starte jobbet" rent faktisk betyder for den pågældende stilling.
  • Nogle certificeringer bruger kriteriebaserede standarder, der ignorerer, hvordan alle andre scorede, og udelukkende fokuserer på, om den enkelte opfyldte en fast grænse.

Standardiseringsmetoder: Sådan bygges professionelle beståelsesgrænser

Højindsatsprøver vælger ikke en beståelsesprocent ud af den blå luft. De bruger dokumenterede standardiseringsmetoder, og at forstå dem forklarer, hvorfor en licenseringseksamen måske består ved 68%, mens en lignende prøve består ved 75%.

Den modificerede Angoff-metode er den mest udbredte opgavecentrerede tilgang. Et panel af fageksperter gennemgår hvert spørgsmål og vurderer sandsynligheden for, at en "minimalt kompetent" kandidat ville besvare det korrekt. Summer disse sandsynligheder på tværs af alle spørgsmål, og du får den anbefalede cut score. Paneler kører typisk flere runder og justerer vurderinger efter at have set faktiske præstationsdata.

Andre tilgange arbejder fra eksaminandsiden i stedet for opgavesiden:

  • Kontrasterende grupper sammenligner scoringsfordelinger af eksaminander, der allerede er klassificeret som kompetente versus endnu-ikke-kompetente, og finder derefter, hvor de to fordelinger krydser hinanden.
  • Grænsegruppe-metoden beder dommere om at identificere eksaminander, der befinder sig lige på kanten af kompetence, og bruger derefter deres faktiske scoringer til at forankre grænsen.
  • Hofstee er en kompromismetode, der på forhånd fastsætter acceptable minimum- og maksimum-dumpefrekvenser, hvilket forhindrer en cut score i at drive til en urimelig yderlighed.
  • Bogmærkemetoden passer til prøver, der er bygget på item response theory, hvor opgaver er ordnet efter sværhedsgrad, og paneldeltagere placerer et "bogmærke" på det punkt, hvor en minimalt kompetent kandidat sandsynligvis ville fejle.

Pro Tip: Hvis din prøve har reelle konsekvenser for kandidater, så kombiner én opgavecentreret metode (som Angoff) med én eksaminandcentreret metode (som kontrasterende grupper). Overensstemmelse mellem de to er noget af det stærkeste bevis, du kan frembringe for, at din cut score er forsvarlig.

Ingen af disse metoder "opdager" en sand beståelsesgrænse. De konstruerer én, gennem ekspertbedømmelse understøttet af data. Den distinktion er værd at dvæle ved, inden du færdiggør enhver grænse, der påvirker rigtige menneskers udfald.

Opbygning af en forsvarlig beståelsesgrænseproces

Inden du kører en formel standardiseringsøvelse, skal du arbejde dig igennem en kort beslutningsliste: Hvor høje er indsatserne? Hvilke opgaveformater er involveret (multiple choice, praktiske opgaver, simuleringer)? Er der en psykometrisk model bag scoringen? Hvor mange kvalificerede paneldeltagere kan du rekruttere, og er din kandidatprøve stor nok til at generere meningsfulde konsekvensdata?

Når du kender problemets form, ser de operationelle trin nogenlunde sådan ud, svarende til hvordan et omfattende Sales Call Scorecard operationaliserer scoring og rubrikker til præstationsvurderinger:

  1. Definer præstationsniveauer i klart sprog. Hvad betyder "minimalt kompetent" rent faktisk for denne rolle eller dette fag?
  2. Rekruttér og træn paneldeltagere, der forstår indholdet og den population, der testes.
  3. Kør den valgte metode (Angoff, kontrasterende grupper, Hofstee eller en kombination) og indsaml uafhængige vurderinger.
  4. Generer konsekvensdata, der viser, hvilken beståelsesrate den foreslåede cut score ville producere mod faktiske eller historiske scoringer.
  5. Dokumentér alle beslutninger: hvem der sad i panelet, hvilken metode der blev brugt, og hvorfor.

Mindre organisationer springer ofte formel psykometrisk støtte over og falder tilbage på en forudindstillet procentsats, hvilket er fint til lavintensitets interne quizzer. For alt, der er knyttet til ansættelse, licensering eller certificering, bør du afsætte ordentlig tid. En tjekliste for evalueringskriterier kan hjælpe med at strukturere præstationsniveaudefinitionerne, inden du involverer et panel.

Scoringer tæt på grænsen: Hvad standardmålefejl betyder for dig

Ingen prøve måler perfekt, og standardmålefejlen (SEM) kvantificerer denne unøjagtighed. En kandidat, der scorer ét point under grænsen, er ikke nødvendigvis mindre kompetent end én, der scorer ét point over den. SEM fortæller dig, hvor meget en ny testscoring sandsynligvis ville svinge, selv uden nogen reel ændring i evne.

  • En grænsezone, ofte cut scoren plus eller minus én SEM, markerer scoringer, der fortjener en ekstra vurdering snarere end en automatisk bestå eller dumpet.
  • Muligheder inden for denne zone inkluderer manuel gennemgang af svarmønstret, målrettet genoptræning efterfulgt af en omprøve, eller en overvåget omprøve under nye betingelser.

Statistik-callout: Fordi scoringsfordelingerne for kompetente og endnu-ikke-kompetente grupper altid overlapper i et vist omfang, fejlklassificerer enhver cut score nogen. Målet med god standardisering er ikke nul fejl. Det er at minimere dem og være transparent om afvejningen.

Alle organisationer skal vælge, hvilken fejl de frygter mest: at lade nogen bestå, der ikke burde have bestået, eller at dumpe nogen, der fortjente at bestå. Dokumentér dette valg. Hvis en tilsynsmyndighed eller en afvist kandidat nogensinde spørger, hvorfor grænsen er sat, hvor den er, er "vi besluttede det som en politisk afgørelse baseret på dette bevis" et langt stærkere svar end tavshed.

Gennemregnede eksempler, du kan genbruge

  1. Standard procentprøve: Samlede point = 100, beståelsesprocent = 60%. Beregning: 100 × 0,60 = 60 point kræves for at bestå.
  2. Anden total, højere grænse: Samlede point = 80, beståelsesprocent = 70%. Beregning: 80 × 0,70 = 56 point. Hvis rå scoringen bliver 55,6, rundes der op til 56, da nedafrunding effektivt ville sænke den offentliggjorte standard.
  3. Vægtet kursuskarakter: Antag, at kursusarbejde og midtvejsprøver allerede bidrager med 45 point ud af mulige 60 (75% på den del), og den afsluttende eksamen er værd 40% af den samlede karakter. For at nå en samlet karakter på 70% skal den afsluttende eksamen levere nok point til at bringe den kombinerede score op på 70 ud af 100, hvilket normalt betyder, at man løser for de præcise point, der kræves på netop denne eksamen ved hjælp af dens egen pointskala snarere end at antage en flad 70% på afslutningseksamen alene.

Sådan understøtter Talent Approved dokumenterede beståelsesgrænse-beslutninger

At køre en forsvarlig standardiseringsproces manuelt betyder at spore paneldeltagerbedømmelser, opgavedata og konsekvensanalyser på tværs af regneark. Talent Approved's arbejdsgange holder dette spor ét sted: genanvendelige opgavebanker til opbygning af rollespecifikke prøver, sessionsdata til gennemgang af præstationsmønstre og AI-genererede oversigter, der viser, hvor kandidater samler sig omkring en foreslået cut score. Se, hvordan man designer jobspecifikke screeningsprøver for en startramme.

Sådan understøtter Talent Approved dokumenterede beståelsesgrænse-beslutninger — oversigtdiagram

Hvorfor dokumentation betyder mere end tallet i sig selv

Den procentsats, du lander på, betyder mindre, end de fleste antager. Det, der faktisk beskytter en organisation, når en beståelsesgrænse anfægtes, er papirspuret bag den: hvem vurderede den, hvilken metode blev brugt, og hvilke beviser understøttede den endelige beslutning. Vælg en metode, der passer til dine indsatser, skriv ned, hvorfor du valgte den, og revurdér dataene, når rigtige kandidater begynder at tage prøven.

— Jimmie

Sæt beståelsesgrænser, du rent faktisk kan forsvare

At opbygge en fair cut score er kun halvdelen af arbejdet. Du har også brug for en måde at teste kandidater konsekvent op imod den på, uden at bruge dage på at opbygge opgavebanker manuelt. Talent Approved's Magic Create-værktøj omdanner en jobbeskrivelse eller en liste over nødvendige kompetencer til en struktureret, rollespecifik prøve på få minutter, så præstationsniveaudefinitionerne bag din beståelsesgrænse faktisk testes på den måde, du havde til hensigt.

Talent Approved

Indbygget anti-snyd-overvågning og sessionsafspilninger giver dig det proceduremæssige bevis, en forsvarlig standardiseringsproces er afhængig af: en registrering af, hvordan hver kandidat faktisk præsterede, ikke blot en endelig score. Kombiner det med AI-genererede oversigter og kandidatrangeringer, og gennemgang af scoringer tæt på din grænse bliver en femminutters opgave i stedet for en manuel revision. Da Talent Approved kører på en pay-as-you-go-model med et fast gebyr på $5 pr. gennemført prøve, er der ingen abonnementsforpligtelse ved at afprøve det mod dine egne rollekrav. Begynd at opbygge en prøve og se, hvordan din foreslåede beståelsesgrænse performer mod faktiske kandidatdata.

Kilder

FAQ

Hvad er en prøvescore?

En prøvescore er det rå eller skalerede tal, en testdeltager opnår, som derefter sammenlignes med en forudbestemt beståelsesgrænse for at klassificere resultatet som bestået eller dumpet.

Hvordan fortolker man prøveresultater tæt på cut scoren?

Scoringer inden for én standardmålefejl fra cut scoren falder i en grænsezone, hvor organisationer ofte anvender manuel gennemgang, genoptræning eller en overvåget omprøve snarere end en automatisk klassificering.

Hvad betragtes som en bestået eksamenscore?

Der er intet universelt tal.