Reliabilitet og validitet: to krav til en test

Firefeltstabell over stabilitet og gyldighet, med badevekt-analogien i feltet der testen er reliabel uten å være valid.

Faglig kvalitetssikret av lærere og toppstudenter · Følger læreplanen (LK20) · Sist oppdatert 2026-09-25

Reliabilitet og validitet: to krav til en test
Firefeltstabell over stabilitet og gyldighet, med badevekt-analogien i feltet der testen er reliabel uten å være valid.

Hva viser visualet?

En god test må være både reliabel og valid. Reliabilitet er stabilitet: gir testen samme resultat om den tas igjen under like forhold? Validitet er gyldighet: måler testen faktisk det vi tror den måler? De to blandes lett, og forskjellen er et kjernepunkt til eksamen.

Analogien fra kilden gjør skillet tydelig. En badevekt som alltid viser 5 kg for lite er helt reliabel — den gir samme resultat hver gang — men den er ikke valid, for den måler systematisk feil vekt. Motsatt kan en test treffe riktig fenomen, men gi resultater som spriker fra gang til gang, og da vet vi ikke hvilken skåre vi skal tro på. En test kan altså være reliabel uten å være valid, men den kan aldri være valid uten først å være reliabel.

Slik leser du visualet

Merkene under står også i bildet.

  1. 1. Best mulig kombinasjon. Bare stabile og gyldige skårer kan brukes til noe fornuftig.
  2. 2. Analogien til å huske. Badevekta er stabil, men systematisk feil — akkurat som en skjev test.
  3. 3. Ustabilt gir ingen mening. Spriker resultatet, kan vi ikke vite hva skåren egentlig viser.

Nøkkelbegreper

  • reliabilitet
  • validitet
  • stabilitet
  • gyldighet
  • systematisk feil
  • standardisering

På prøve og muntlig

Oppgave: Forklar forskjellen på reliabilitet og validitet, og bruk et eksempel. Svar: Reliabilitet handler om stabilitet — gir testen samme resultat om den tas igjen under like forhold? Validitet handler om gyldighet — måler testen faktisk det den er ment å måle? En badevekt som alltid viser 5 kg for lite illustrerer forskjellen: den er svært reliabel, fordi den gir samme resultat hver gang, men den er ikke valid, fordi den systematisk måler feil. Motsatt hjelper det ikke å måle riktig fenomen hvis resultatet spriker fra gang til gang. En test kan derfor være reliabel uten å være valid, men aldri valid uten å være reliabel. For intelligenstester betyr dette at både stabile skårer og god dokumentasjon på hva skåren faktisk fanger, er nødvendig.

Kildegrunnlag

kilder/intelligens.md — «Måling av intelligens – IQ», sensorboksen med badevekt-analogien

Relaterte sider

← Tilbake til ifingo