Konfidensintervall

Sammenlign Beregninger

Nedlastinger

Inkluderer dine inndata og resultater for denne beregningen, pluss eventuelle ytterligere beregninger du har sammenlignet.

Greit Å Vite

Denne kalkulatoren bruker z-fordelingen, som forutsetter et stort utvalg eller et kjent populasjonsstandardavvik. For små utvalg (færre enn omtrent 30) med et estimert standardavvik er t-fordelingen teknisk sett mer nøyaktig og vil gi et litt bredere intervall enn det som vises her.

Slik Beregnes Konfidensintervallet

Et konfidensintervall er et verdiområde, bygget rundt et utvalgs eget gjennomsnitt, som sannsynligvis inneholder det sanne populasjonsgjennomsnittet. Angi et utvalgs gjennomsnitt, standardavvik, og størrelse, velg et konfidensnivå, så finner denne kalkulatoren området innenfor hvilket det faktiske populasjonsgjennomsnittet sannsynligvis faller.

Et “95% konfidensintervall,” for eksempel, betyr at hvis du gjentok den samme utvalgsprosessen mange ganger, ville omtrent 95% av intervallene det produserte inneholde det sanne populasjonsgjennomsnittet. Det betyr ikke at det er 95% sjanse for at det sanne gjennomsnittet faller innenfor dette ene spesifikke intervallet — en vanlig, teknisk feilaktig måte folk uttrykker det på. Et bredere intervall (høyere konfidensnivå) kaster et bredere nett og er mer sannsynlig å inneholde det sanne gjennomsnittet; et smalere intervall er mer presist men mindre sikkert.

Formelen

Standardfeil=sn\vE{\text{Standardfeil}} = \frac{\vA{s}}{\sqrt{\vB{n}}} Feilmargin=z×Standardfeil\vF{\text{Feilmargin}} = \vC{z} \times \vE{\text{Standardfeil}} Konfidensintervall=xˉ±Feilmargin\text{Konfidensintervall} = \vD{\bar{x}} \pm \vF{\text{Feilmargin}}

Hvor s\vA{s} er utvalgets standardavvik, n\vB{n} er utvalgsstørrelsen, z\vC{z} er den kritiske verdien for det valgte konfidensnivået (slått opp fra standard normalfordeling), og xˉ\vD{\bar{x}} er utvalgsgjennomsnittet. En større utvalgsstørrelse krymper standardfeilen — og dermed hele intervallet — siden mer data gir et mer presist estimat av det sanne gjennomsnittet.

Regneeksempel

Et utvalg på 25 elementer har et gjennomsnitt på 100 og et standardavvik på 15, ved et 95%-konfidensnivå (en kritisk verdi z = 1,96):

    1. Standardfeil: Standardfeil=15÷25=3\vE{\text{Standardfeil}} = \vA{15} \div \sqrt{\vB{25}} = \vE{3}.
    2. Feilmargin: Feilmargin=1,96×3=5,88\vF{\text{Feilmargin}} = \vC{1,96} \times \vE{3} = \vF{5,88}.
    3. Konfidensintervall: Konfidensintervall=100±5,88=[94,12,105,88]\text{Konfidensintervall} = \vD{100} \pm \vF{5,88} = [94,12, 105,88].

Så det sanne populasjonsgjennomsnittet er sannsynligvis (med 95% konfidens) et sted mellom 94,12 og 105,88.

Viktige Faktorer å Vurdere

  • Et konfidensintervall sier ingenting om hvordan utvalget ble samlet inn. Matematikken her antar at utvalget er et genuint tilfeldig, representativt utvalg av populasjonen — en skjev eller ikke-tilfeldig utvalgsmetode kan produsere et konfidensintervall som ser presist ut, men som er sentrert på helt feil verdi, et problem denne formelen ikke kan oppdage eller korrigere for.
  • Intervallet antar at de underliggende dataene i det minste er tilnærmet normalfordelt, eller at utvalget er stort nok til at sentralgrenseteoremet gjelder. For et lite utvalg fra en sterkt skjev fordeling blir både z-fordelings- og t-fordelingstilnærmingene mindre pålitelige.
  • Et konfidensintervall og en feilmargin rapportert i en meningsmåling eller undersøkelse beskriver den samme underliggende ideen. En nyhetsrapport som siterer «en feilmargin på pluss eller minus 3 prosentpoeng» ved et angitt konfidensnivå (ofte 95%) beskriver nøyaktig intervallet denne kalkulatoren beregner, bare uttrykt annerledes.
  • Smalere er ikke alltid bedre hvis det går på bekostning av konfidens. Et strammere intervall ved et lavere konfidensnivå (si 80% i stedet for 95%) er mer presist, men mindre sannsynlig å faktisk inneholde den sanne verdien — den riktige avveiningen mellom presisjon og konfidens avhenger av hva estimatet skal brukes til.

Vanlige Feil

  • Å tolke “95% konfidens” som “95% sannsynlighet for at det sanne gjennomsnittet er i dette intervallet.” Når et utvalg faktisk er samlet inn og intervallet beregnet, er det sanne populasjonsgjennomsnittet enten inni det eller ikke — det er ingen sannsynlighet igjen å snakke om. De 95% beskriver METODENS langsiktige oppførsel på tvers av mange gjentatte utvalg, ikke dette ene spesifikke resultatet.
  • Å bruke denne z-baserte formelen på et lite utvalg uten å sjekke forutsetningene. Z-fordelingen forutsetter enten et stort utvalg (konvensjonelt n på omtrent 30 eller mer) eller et kjent standardavvik for populasjonen. Et lite utvalg med bare et estimert standardavvik bør teknisk sett bruke t-fordelingen i stedet, som gir et noe bredere — og mer ærlig — intervall.
  • Å forveksle konfidensintervallet med spennvidden til rådataene. Intervallet beskriver usikkerhet om populasjonsgjennomsnittet, ikke hvor individuelle datapunkter faller — et datasett kan ha verdier spredt langt bredere enn konfidensintervallet, mens intervallet rundt selve gjennomsnittet forblir smalt, spesielt med et stort utvalg.

Verdt å Vite

Siden standardfeilen krymper med kvadratroten av utvalgsstørrelsen fremfor selve utvalgsstørrelsen, betyr det å halvere en feilmargin vanligvis at man må firedoble utvalgsstørrelsen, ikke bare doble den — et detalj som betyr noe når man planlegger hvor stor en undersøkelse eller et eksperiment faktisk trenger å være. Dette forklarer også hvorfor meningsmålinger med bare noen få hundre respondenter fortsatt kan rapportere en respektabelt smal feilmargin: når et utvalg når noen få hundre, betyr kvadratrot-forholdet at hver ekstra respondent gir gradvis mindre presisjon, så meningsmålingsinstitutter ser sjelden verdien i å øke utvalgsstørrelser til titusenvis bare for å barbere en brøkdel av et poeng av marginen.

Kilde: Standard statistisk inferensformel ved bruk av z-fordelingen.

Ofte Stilte Spørsmål

Hva betyr "95% konfidens" egentlig?

Det betyr at hvis du gjentok den samme utvalgsprosessen mange ganger, ville omtrent 95% av de resulterende intervallene inneholde det sanne populasjonsgjennomsnittet. Det betyr IKKE at det er 95% sjanse for at det sanne gjennomsnittet faller innenfor dette ENE spesifikke intervallet — en vanlig men teknisk feilaktig måte å uttrykke det på.

Hvorfor krymper en større utvalgsstørrelse intervallet?

Standardfeilen (og dermed feilmargin) deles på kvadratroten av utvalgsstørrelsen, så mer data gir et mer presist — og smalere — estimat av det sanne populasjonsgjennomsnittet.

Bør jeg bruke z-fordelingen eller t-fordelingen?

Z-fordelingen (brukt her) er standard for store utvalg (n på omtrent 30 eller mer) eller når populasjonens sanne standardavvik allerede er kjent. For et lite utvalg med bare et estimert standardavvik er t-fordelingen teknisk mer nøyaktig og gir et litt bredere intervall.

Hva skjer hvis jeg velger et høyere konfidensnivå?

Et høyere konfidensnivå (f.eks. 99% i stedet for 95%) bruker en større kritisk z-verdi, som utvider intervallet. Dette er en uunngåelig avveining: å kaste et bredere nett gjør det mer sannsynlig at det sanne gjennomsnittet faktisk er innenfor intervallet, på bekostning av et mindre presist estimat.

Hvor mye større må utvalget mitt være for å halvere feilmarginen?

Omtrent fire ganger større, ikke to. Standardfeilen krymper med kvadratroten av utvalgsstørrelsen, så å halvere feilmarginen krever å firedoble antall observasjoner -- en nyttig tommelfingerregel når man planlegger hvor stor en undersøkelse eller et eksperiment faktisk trenger å være.

Sier et konfidensintervall noe om hvordan utvalget ble samlet inn?

Nei -- matematikken forutsetter at utvalget er genuint tilfeldig og representativt for populasjonen. En skjev eller ikke-tilfeldig utvalgsmetode kan fortsatt produsere et konfidensintervall som ser presist ut, men som er sentrert på en helt feil verdi -- et problem denne formelen ikke har noen måte å oppdage eller korrigere for.

Er et konfidensintervall det samme som en feilmargin?

De beskriver samme underliggende idé fra to vinkler: feilmarginen er pluss-eller-minus-avstanden fra utvalgsgjennomsnittet, mens konfidensintervallet er hele området den avstanden skaper rundt det. En nyhetsrapport som siterer «en feilmargin på pluss eller minus 3 prosentpoeng» ved et angitt konfidensnivå beskriver nøyaktig intervallet denne kalkulatoren beregner.

Bekreft alderen din

For å opprette en konto, oppgi fødselsmåned og -år.