Firefeltstabell over stabilitet og gyldighet, med badevekt-analogien i feltet der testen er reliabel uten å være valid.
Faglig kvalitetssikret av lærere og toppstudenter · Følger læreplanen (LK20) · Sist oppdatert 2026-09-25
En god test må være både reliabel og valid. Reliabilitet er stabilitet: gir testen samme resultat om den tas igjen under like forhold? Validitet er gyldighet: måler testen faktisk det vi tror den måler? De to blandes lett, og forskjellen er et kjernepunkt til eksamen.
Analogien fra kilden gjør skillet tydelig. En badevekt som alltid viser 5 kg for lite er helt reliabel — den gir samme resultat hver gang — men den er ikke valid, for den måler systematisk feil vekt. Motsatt kan en test treffe riktig fenomen, men gi resultater som spriker fra gang til gang, og da vet vi ikke hvilken skåre vi skal tro på. En test kan altså være reliabel uten å være valid, men den kan aldri være valid uten først å være reliabel.
Merkene under står også i bildet.
Oppgave: Forklar forskjellen på reliabilitet og validitet, og bruk et eksempel. Svar: Reliabilitet handler om stabilitet — gir testen samme resultat om den tas igjen under like forhold? Validitet handler om gyldighet — måler testen faktisk det den er ment å måle? En badevekt som alltid viser 5 kg for lite illustrerer forskjellen: den er svært reliabel, fordi den gir samme resultat hver gang, men den er ikke valid, fordi den systematisk måler feil. Motsatt hjelper det ikke å måle riktig fenomen hvis resultatet spriker fra gang til gang. En test kan derfor være reliabel uten å være valid, men aldri valid uten å være reliabel. For intelligenstester betyr dette at både stabile skårer og god dokumentasjon på hva skåren faktisk fanger, er nødvendig.
kilder/intelligens.md — «Måling av intelligens – IQ», sensorboksen med badevekt-analogien