Så Beräknas Konfidensintervallet
Ett konfidensintervall är ett intervall av värden, byggt kring ett stickprovs eget medelvärde, som sannolikt innehåller det verkliga populationsmedelvärdet. Ange ett stickprovs medelvärde, standardavvikelse och storlek, välj en konfidensnivå, så hittar denna kalkylator intervallet inom vilket det faktiska populationsmedelvärdet sannolikt faller.
Ett “95-procentigt konfidensintervall,” till exempel, betyder att om du upprepade samma urvalsprocess många gånger skulle omkring 95 % av de intervall den producerade innehålla det verkliga populationsmedelvärdet. Det betyder inte att det finns en 95-procentig chans att det verkliga medelvärdet faller inom just detta specifika intervall — ett vanligt, tekniskt felaktigt sätt folk uttrycker det på. Ett bredare intervall (högre konfidensnivå) kastar ett bredare nät och är mer sannolikt att innehålla det verkliga medelvärdet; ett smalare intervall är mer precist men mindre säkert.
Formeln
Där är stickprovets standardavvikelse, är stickprovsstorleken, är det kritiska värdet för den valda konfidensnivån (uppslaget från standardnormalfördelningen), och är stickprovets medelvärde. En större stickprovsstorlek krymper standardfelet — och därmed hela intervallet — eftersom mer data ger en mer precis uppskattning av det verkliga medelvärdet.
Räkneexempel
Ett stickprov av 25 objekt har ett medelvärde på 100 och en standardavvikelse på 15, vid en 95-procentig konfidensnivå (ett kritiskt värde av z = 1,96):
- Standardfel: .
- Felmarginal: .
- Konfidensintervall: .
Så det verkliga populationsmedelvärdet ligger sannolikt (med 95 % konfidens) någonstans mellan 94,12 och 105,88.
Viktiga Faktorer Att Tänka På
- Ett konfidensintervall säger ingenting om hur stickprovet samlades in. Matematiken här förutsätter att stickprovet är ett genuint slumpmässigt, representativt urval av populationen — en snedvriden eller icke-slumpmässig urvalsmetod kan producera ett konfidensintervall som ser precist ut men som är centrerat kring helt fel värde, ett problem denna formel varken kan upptäcka eller korrigera för.
- Intervallet förutsätter att den underliggande datan åtminstone är ungefär normalfördelad, eller att stickprovet är tillräckligt stort för att centrala gränsvärdessatsen ska gälla. För ett litet stickprov från en kraftigt skev fördelning blir både z-fördelnings- och t-fördelningsapproximationerna mindre tillförlitliga.
- Ett konfidensintervall och en felmarginal som rapporteras i en opinionsundersökning beskriver samma underliggande idé. En nyhetsrapport som anger “en felmarginal på plus eller minus 3 procentenheter” vid en angiven konfidensnivå (ofta 95 %) beskriver exakt det intervall denna kalkylator beräknar, bara formulerat annorlunda.
- Smalare är inte alltid bättre om det sker på bekostnad av konfidens. Ett snävare intervall vid en lägre konfidensnivå (säg 80 % istället för 95 %) är mer precist men mindre sannolikt att faktiskt innehålla det verkliga värdet — den rätta avvägningen mellan precision och konfidens beror på vad uppskattningen ska användas till.
Vanliga Misstag
- Att tolka “95 % konfidens” som “95 % sannolikhet att det verkliga medelvärdet ligger i detta intervall.” När ett stickprov faktiskt har samlats in och intervallet beräknats, ligger det verkliga populationsmedelvärdet antingen inuti det eller inte — det finns ingen sannolikhet kvar att tala om. De 95 % beskriver METODENS långsiktiga beteende över många upprepade stickprov, inte just detta enda specifika resultat.
- Att tillämpa denna z-baserade formel på ett litet stickprov utan att kontrollera antagandena. Z-fördelningen förutsätter antingen ett stort stickprov (konventionellt n på omkring 30 eller mer) eller en känd standardavvikelse för populationen. Ett litet stickprov med endast en uppskattad standardavvikelse bör tekniskt sett använda t-fördelningen istället, vilket ger ett något bredare — och ärligare — intervall.
- Att förväxla konfidensintervallet med rådatans spännvidd. Intervallet beskriver osäkerhet om populationsmedelvärdet, inte var enskilda datapunkter hamnar — ett dataset kan ha värden spridda mycket bredare än dess konfidensintervall, medan intervallet kring själva medelvärdet förblir smalt, särskilt vid ett stort stickprov.
Bra Att Veta
Eftersom standardfelet krymper med kvadratroten av stickprovsstorleken snarare än stickprovsstorleken själv, innebär en halvering av felmarginalen i allmänhet en fyrdubbling av stickprovsstorleken, inte bara en fördubbling — en detalj som spelar roll vid planering av hur stor en undersökning eller ett experiment faktiskt behöver vara. Detta förklarar också varför opinionsundersökningar med bara några hundra respondenter ändå kan rapportera en respektabelt snäv felmarginal: när ett stickprov når några hundra innebär kvadratrotssambandet att varje ytterligare respondent gradvis ger mindre precision, så opinionsundersökare ser sällan värdet i att driva upp stickprovsstorlekar till tiotusentals bara för att raka bort en bråkdel av en procentenhet från marginalen.