Vurderingstilgængelighed: NCEO-trin, seks linser og hurtige brugbarhedspilotter

Vurderingstilgængelighed: NCEO-trin, seks linser og hurtige brugbarhedspilotter

Tilgængelighed i forbindelse med evalueringer betyder, at tests designes, så de måler den tilsigtede færdighed for alle lærende, uanset handicap, sproglig baggrund eller måde at interagere med teknologi på. Det enkelt mest nyttige første skridt er at planlægge universelt design, inden der skrives et eneste spørgsmål, og derefter gennemføre en tilgængelighedskontrol på elementniveau, inden testen nogensinde når frem til en testdeltager. Føderal lovgivning bakker dette op: ADA kræver, at testorganisationer tilbyder eksamener et sted og på en måde, der er tilgængelig for personer med handicap.


TL;DR:

  • Universelt design bør planlægges fra starten, med tilgængelige formater som tagget PDF eller HTML, for at undgå dyre efterfølgende tilpasninger.
  • Støtteforanstaltninger er kategoriseret i universelle værktøjer, udpegede støtteforanstaltninger og tilpasninger, der hver kræver forskellige niveauer af godkendelse og dokumentation.
  • Tilgængelighedsbeslutninger skal træffes hurtigt for at forhindre afvisning af lige muligheder, og tilpasninger bør ikke underminere evalueringens validitet.
  • Gennemførelse af tilgængeligheds­gennemgange på elementniveau og brugervenlighedspilotforsøg med brugere af hjælpeteknologi kan afsløre barrierer, som overholdelseskontroller muligvis overser.
  • At integrere evalueringsværktøjer i undervisningen og gennemføre mindre pilottests kan markant forbedre testdeltagernes resultater og reducere behovet for særlige testsessioner.

Talent Approved
Byg mere fokuserede evalueringer
Talent Approved hjælper arbejdsgivere med at skabe rollespecifikke færdighedsevalueringer og gennemgå kandidaters kompetencer ud over CV'er.

Indholdsfortegnelse

Hvad tilgængelighed i evalueringer faktisk omfatter

De fleste evalueringsprogrammer organiserer støtteforanstaltninger i tre niveauer, og at forveksle dem er en af de mest almindelige fejl, teams begår. Universelle værktøjer er tilgængelige for alle testdeltagere, uden at der kræves en anmodning. Tænk tekst-til-tale, zoom, fremhævere og svarafskærmning. Udpegede støtteforanstaltninger kræver en beslutning fra en underviser eller et team, typisk fordi funktionen ændrer testoplevelsen for nogle elever, som f.eks. ændringer i farvekontrast eller en separat testplacering. Tilpasninger er den mest restriktive kategori, knyttet til en dokumenteret plan som en IEP eller 504, og de omfatter ofte ting som forlænget tid eller en skriver.

Statslige testprogrammer illustrerer dette godt. California Department of Educations matrix over tilgængeligheds­ressourcer viser snesevis af integrerede og ikke-integrerede støtteforanstaltninger på tværs af disse tre niveauer for sine statsomfattende evalueringer. Skelnen har operationel betydning:

  • Universelle værktøjer kræver nul papirarbejde og bør være tilgængelige i den daglige undervisning, ikke kun på testdagen.
  • Udpegede støtteforanstaltninger kræver en teambeslutning, men ikke en medicinsk eller pædagogisk diagnose.
  • Tilpasninger kræver dokumentation og bliver typisk registreret i et tilmeldingssystem, inden testningen begynder.

Afsnit 309 i ADA er ankerreglen for enhver organisation, der administrerer eksamener, fra licens­nævn til certificeringsprogrammer for arbejdsstyrken. Det kræver, at testorganisationer tilbyder eksamener "et sted og på en måde, der er tilgængelig for personer med handicap", og at de tilbyder rimelige tilpasninger på anmodning, ifølge Justitsministeriets vejledning om testtilpasninger.

Dokumentationsstandarden er snævrere, end de fleste antager. Testorganisationer kan anmode om dokumentation, men den skal være rimelig og snævert afgrænset, ikke en udtømmende papirstrøm. At acceptere dokumentation fra en kvalificeret fagperson uden at kræve overdreven yderligere dokumentation forkorter godkendelsestidslinjer og holder processen i overensstemmelse med lovgivningen.

To forpligtelser volder evalueringsteams mest besvær: rettidighed og bevarelse af validitet. En beslutning om en anmodning om tilpasning må ikke stå i kø i uger. Forsinkede svar kan svare til en afvisning af lige muligheder, ifølge det samme tekniske assistancedokument fra ADA. Og uanset hvilken tilpasning der gives, skal den bevare det, som testen måler. En højttlæsningstilpasning på en læseforståelses­eksamen kan f.eks. underminere selve det konstrukt, testen forsøger at vurdere, og det er grunden til, at licensorganer gransker disse beslutninger nøje.

Arbejdsgang for beslutning om evalueringstilpasning

Universelt design i praksis: Omsæt NCEO's trin til handling

National Center on Educational Outcomes beskriver en ni-trins proces til at bygge evalueringer med tilgængelighed indbygget fra dag ét, som beskrevet i sin statsvejledning til universelt designede evalueringer. Kondenseret til praktiske skridt ser det sådan ud for et evalueringsteam:

  1. Planlæg for tilgængelighed, inden der skrives spørgsmål, ikke efter at et pilotforsøg afslører problemer.
  2. Definer konstruktet præcist, så du ved, hvad testen skal måle, og hvad der er utilsigtet ved det.
  3. Kræv universelt design i leverandørers udbudsmateriale, så tilgængelighed ikke er et ulønnet tillæg, der anmodes om senere.
  4. Inddrag tilgængeligheds­ekspertise under spørgsmålsskrivning, ikke kun under en overholdelsesgennemgang.
  5. Gennemfør brugervenlighedstests med et repræsentativt udsnit, inden testen går live.
  6. Gennemfør afprøvninger af spørgsmål og test, og analyser derefter resultaterne inden fuld udrulning.
  7. Overvåg og revider i hver cyklus, da tilgængeligheds­behov skifter i takt med, at befolkninger og teknologi ændrer sig.

Den tekniske side er lige så vigtig som processen. Byg evalueringer i semantiske, interoperable formater som tagget PDF, HTML eller QTI, hvor det understøttes, frem for lukkede proprietære filer, der kræver manuel afhjælpning senere – et punkt, der understreges i Massachusetts DOE's tekniske vejledning. At tilpasse sig WCAG- og Section 508-standarder fra starten undgår dyre efterfølgende tilpasninger.

Pro tip: Brug de samme tilgængeligheds­værktøjer under undervisningen, som du planlægger at bruge under evalueringen. Når elever allerede ved, hvordan deres tekst-til-tale- eller zoomværktøj fungerer, måler testen færdigheden, ikke deres evne til at lære en ny grænseflade under pres.

En praktisk tilgængeligheds­tjekliste på elementniveau

At opdage barrierer, inden en test lanceres, er langt billigere end at rette dem, efter en gruppe allerede har gennemført den. Massachusetts DOE byggede en tjekliste og et gennemgangsprotokol op om seks linser, som ethvert team kan tilpasse.

  • Sprogkrav: Er ordforrådet mere komplekst, end konstruktet kræver?
  • Kulturel bias: Antager spørgsmålet en fælles erfaring, som nogle testdeltagere ikke vil have?
  • Færdighedskrav: Tester spørgsmålet den tilsigtede færdighed, eller tester det også stille og roligt læsehastighed eller motorisk koordination?
  • Præsentation og læsbarhed: Vil teksttæthed, skriftstørrelse eller layout unødigt forsinke en svagsynet læser?
  • Svarform: Kan en testdeltager svare, hvis de ikke kan bruge en mus, eller ikke kan skrive i hånden?
  • Træthed: Vil spørgsmålets længde eller testens varighed introducere fejl, der er irrelevante for den færdighed, der måles?

Gennemgangs­protokollen fungerer bedst som en teamsport. Tildel anmeldere til specifikke linser, log hvert problem med en specifik placering og et foreslået fix, og saml derefter op for at konsolidere revisioner frem for at lade én person afgøre alt alene.

Hyppig barriere fundet Konkret løsning
Flertrins­opgave begravet i én lang stamme Opdel i sekventielle, separat bedømte trin
Billede eller diagram uden tekstalternativ Tilføj beskrivende alt-tekst, der formidler den samme information
Enkelt svarform (kun skrivning) Tilbyd stemmeinput eller multiple choice som en alternativ vej
Overdrevent kompleks sætningsstruktur Forenkel stammen uden at fjerne det testede koncept

At teste testen: Brugervenlighedstest og tilgængeligheds­pilotforsøg

Det kræver ikke et specialiseret laboratorium at gennemføre et brugervenlighedspilotforsøg. En fjern­tænk-højt-session, hvor et antal testdeltagere fortæller om deres tankeproces, mens de arbejder sig gennem spørgsmål, afdækker hurtigt gnidningspunkter. En gennemgang med skærmlæser med blot tre eller fire brugere af hjælpeteknologi opfanger problemer, som en spørgsmålsskriver uden handicap aldrig vil opdage, som f.eks. et diagram, der læses som en meningsløs talrække.

De målinger, der er værd at følge, er ligetil:

Måling Hvad den afslører
Opgavegennemførelsesrate Om spørgsmålet overhovedet kan besvares med hjælpeteknologi
Tid på opgaven Om træthed eller navigationsvanskeligheder oppuster gennemførelsestiden
Observerede barrierer Specifikke punkter, hvor en testdeltager gik i stå eller blev forvirret
Kompatibilitet med hjælpeteknologi Om skærmlæsere eller forstørrelsesværktøjer opfører sig som forventet

Den sværere disciplin er at kombinere disse brugervenlighedsfund med psykometriske kontroller. Et tilgængeligheds­fix, der ændrer spørgsmålets sværhedsgrad eller viser differentiel spørgsmålsfunktion på tværs af grupper, kræver endnu et kig, inden det sendes videre – et trin, som NCEO's vejledning behandler som uundgåeligt. Tilgængelighed og validitet er ikke konkurrerende mål. At gennemgå dem sammen, frem for sekventielt, er det, der forhindrer et fix i at bryde, hvad testen måler, uden at man opdager det. Teams, der har brug for en struktureret måde at spore denne type data på elementniveau, kan finde det nyttigt at læse om målingsfokuserede evalueringsanalyser.

Træning og kommunikation til testadministratorer

Tilpasninger virker kun, hvis de mennesker, der driver testdagen, ved, hvordan de aktiveres. Administratortræning bør dække korrekt forudindtastning af integrerede indstillinger, håndtering af last-minute-anmodninger om tilpasning uden at afspore tidsplanen og bekræftelse af, at hjælpeteknologi og enheder faktisk fungerer, inden testvindeuet åbner – en praksis, der afspejles i Smarter Balanced's retningslinjer for brugervenlighed og tilpasninger.

Familier og lærende har også brug for forudgående besked samt mulighed for at øve sig med de faktiske værktøjer, inden indsatsen er reel.

  • Bekræft, at integrerede indstillinger er indtastet, inden testvindeuet åbner.
  • Giv testdeltagerne en øvelsessession med de præcise værktøjer, de vil bruge på testdagen.
  • Tjek enheder, høretelefoner og hjælpeteknologi dagen før, ikke om morgenen.

Pro tip: Send bekræftelser af tilpasninger skriftligt mindst en uge inden testning. Et mundtligt "ja", der aldrig kommer ind i systemet, er den absolut hyppigste årsag til fejl med tilpasninger på testdagen.

Hvad sker der, når teams faktisk følger universelt design

Evalueringsteams, der bygger tilgængelighed ind fra starten – frem for at eftermontere den efter en klage – har tendens til at se færre særlige testsessioner at planlægge og højere gennemførelsesrater generelt. At integrere værktøjer som tekst-til-tale i den daglige undervisning, ikke kun i testen, viser målbare forbedringer i gennemførelse og testdeltagernes selvtillid, ifølge ReadSpeakers artikel om inkluderende eksamensdesign.

Platforme kan fremskynde dele af denne arbejdsgang, men de erstatter ikke den menneskelige vurdering bag den. Et værktøj kan markere et manglende alt-tekst-tag; det kan ikke afgøre, om en tilpasning bevarer det konstrukt, du tester. Det ansvar forbliver hos designteamet, uanset hvor meget automatisering der omgiver det.

Tjeklisten slår leverandørens salgstale

Her er, hvad forskningen på dette område faktisk understøtter, og det går imod en masse konventionelle råd: at købe en "tilgængelig" testplatform er ikke det samme som at have en tilgængelig evaluering. Leverandører af overholdelsesløsninger vil gerne sælge dig WCAG-overensstemmelse på leveringslaget, mens spørgsmålene selv stadig begraver et matematikproblem inde i tre sætninger med irrelevant kontekst, eller antager kulturel viden, der ikke har noget at gøre med den færdighed, der måles. Platformen var aldrig det svage led.

Tjeklisten slår leverandørens salgstale — oversigtsdiagram

Tjeklisten på elementniveau er uglamorøs, og det er præcis grunden til, at de fleste teams springer den over. Det er ikke en indkøbsbeslutning. Det er en tirsdagseftermiddag brugt med tre anmeldere, der diskuterer, om et matematikproblems ordforråd tester matematik eller læsning. Den diskussion, gentaget for hvert spørgsmål på testen, er der, hvor tilgængelighed faktisk bygges. Leverandørers tilgængeligheds­funktioner er vigtige, men de er et gulv, ikke en strategi.

Hvis du kun gør én ting anderledes efter at have læst dette, så lad det være brugervenlighedsundersøgelsen. En lille gruppe brugere af hjælpeteknologi, der arbejder sig igennem din test, kan afsløre flere reelle barrierer, end en overholdelses­revision ofte vil, og du behøver ikke et specialiseret laboratorium eller en leverandørkontrakt for at gennemføre den.

— Jimmie

Hvor Talent Approved passer ind i en tilgængelig arbejdsgang

Talent Approved erstatter ikke din spørgsmålsgennemgangs­protokol, og det bør den heller ikke forsøge. Det, den gør godt, er at fjerne den manuelle byrde fra de dele af arbejdsgangen, der sluger mest tid. Et værktøj, der på få minutter bygger en rollespecifik evaluering ud fra en jobbeskrivelse, lader dine anmeldere bruge deres timer på de tilgængeligheds­linser, der betyder noget – sprog, kultur, færdighedskrav, træthed – i stedet for at udarbejde spørgsmål fra bunden.

Talent Approved

Anti-snydeovervågning og AI-genererede præstations­resuméer kan håndtere gennemgangssiden, når tests er live, og giver ansættelsesteams et klart, konsistent overblik over resultaterne uden at tilføje administrativ byrde til behandlingen af tilpasninger. Intet af dette erstatter planlægning af universelt design fra starten eller gennemførelse af dit eget brugervenlighedspilotforsøg. Det betyder blot, at værktøjerne omkring disse beslutninger ikke bremser dig. Hvis dit team er klar til at bygge en rollespecifik evaluering og se, hvordan arbejdsgangen holder op mod din egen tilgængeligheds­tjekliste, kan du prøve Talent Approved direkte.

Kilder

FAQ

Hvad er tilgængelighed i evalueringer?

Tilgængelighed i evalueringer betyder, at en test måler den tilsigtede færdighed eller viden for alle testdeltagere, uanset handicap, sproglig baggrund eller den teknologi, de bruger til at svare. Det kræver design med universelle værktøjer, udpegede støtteforanstaltninger og tilpasninger indbygget frem for tilføjet efterfølgende.

Hvad er eksempler på evalueringstilpasninger?

Almindelige tilpasninger omfatter forlænget tid, en skriver eller oplæser, en separat testplacering, kompatibilitet med skærmlæser og alternative svarformer som stemmeinput. Tilpasninger er typisk knyttet til dokumentation som en IEP eller 504-plan, i modsætning til universelle værktøjer, som er tilgængelige for alle.

Hvad er de fire typer af tilgængeligheds­barrierer, man bør kontrollere for?

En praktisk gennemgang kontrollerer fire kerneområder: sprogkrav, kulturel bias, færdighedskrav ud over det testede konstrukt og fysiske eller sensoriske barrierer som præsentation, læsbarhed og svarform. Træthed fra testlængde er en femte linse, som mange teams tilføjer for at opfange fejl, der er irrelevante for den færdighed, der måles.

Hvilke værktøjer understøtter tilgængelige onlineevalueringer?

Universelle værktøjer som tekst-til-tale, zoom og svarafskærmning, kombineret med semantiske og interoperable filformater som tagget PDF eller HTML, udgør den tekniske rygrad af tilgængelig onlinetestning. Platforme som Talent Approved kan fremskynde opbygningen af rollespecifikke tests, men tilgængeligheds­gennemgangen og brugervenlighedstest skal stadig finde sted på selve spørgsmåls­indholdet.

Hvor lang tid bør beslutninger om tilpasninger tage?

ADA fastsætter ikke et fast antal dage, men vejledningen er klar på, at unødvendige forsinkelser kan svare til en afvisning af lige muligheder. Testorganisationer bør indbygge en svartidslinje i deres proces frem for at lade anmodninger om tilpasning stå ubesvaret tæt på testdagen.