Data Science Academy · leksjon

Spredning: varians og standardavvik

Hvor bredt dataene faktisk er spredt.

Leksjon 2 av 413 trinn

Spredning: varians og standardavvik er en gratis leksjon i Data Science Academy på CoddyKit. Dette er leksjon 2 av 4. Du kan lese hele leksjonen gratis nedenfor – og deretter øve praktisk i nettleseren med en innebygd kodeeditor og en AI-veileder som er tilgjengelig døgnet rundt. Den er en del av læringsløpet i Data Science Academy, og fremdriften din synkroniseres mellom nettet og CoddyKit-appen. Kurset i Data Science Academy inneholder totalt 4 leksjoner.

Sentrum er ikke nok

To kolonner kan ha samme gjennomsnitt og likevel se helt forskjellige ut. For å skille dem måler du spredningen, altså hvor bredt verdiene varierer. 📏

Avvik fra gjennomsnittet

Spredning begynner med avstanden fra hvert punkt til gjennomsnittet, altså punktets avvik. Små avvik betyr tettliggende data, mens store avvik betyr at dataene sprer seg mye.

Hvorfor vi kvadrerer avvik

Positive og negative avvik ville opphevet hverandre og gitt null. Derfor kvadrerer vi hvert avvik først, slik at hvert avvik blir et positivt bidrag.

Varians forklart

Variansen er gjennomsnittet av de kvadrerte avvikene. Større varians betyr at verdiene i gjennomsnitt ligger lenger fra gjennomsnittet.

df["price"].var()

Problemet med enhetene

Kvadrering gjør også enhetene større. Variansen til priser i kroner blir angitt i kvadratkroner, noe som er vanskelig å forstå ved første øyekast.

Standardavviket redder dagen

Ta kvadratroten av variansen, så får du standardavviket. Det bruker samme enhet som dataene dine, og blir derfor meningsfullt.

df["price"].std()

Tolk standardavvik

Standardavviket er omtrent den typiske avstanden et punkt har fra gjennomsnittet. Et lite std betyr stabile verdier, mens et stort betyr stor variasjon.

68-prosentregelen

For data som omtrent følger en klokkeformet fordeling, ligger rundt 68 prosent av verdiene innenfor ett standardavvik fra gjennomsnittet. Det er en rask kontroll av intervallet.

Utvalg kontra populasjon

pandas deler som standard på n minus én, altså utvalgsversjonen. Denne lille justeringen korrigerer skjevhet når dataene bare er et utvalg fra en større gruppe.

Spredning gjør sammenligning mulig

Standardavviket lar deg sammenligne stabilitet på en rettferdig måte. Produktet med lavest std for leveringstid er det mest pålitelige.

Begge på ett blikk

Du trenger ikke velge mellom dem manuelt. Resultatet fra describe inneholder allerede std for hver numeriske kolonne du har.

df.describe().loc["std"]

Hurtigsjekk

Du ønsker et mål på spredning som bruker samme enhet som de opprinnelige dataene.

Oppsummering: Måle spredning

Du har lært at variansen beregner gjennomsnittet av kvadrerte avstander, og at standardavviket fører dette tilbake til de opprinnelige enhetene. Sammen viser de hvor mye dataene dine varierer. 🌟

Gratis å komme i gang

Lær deg Python med en AI-veileder – gratis

Skriv og kjør ekte kode i nettleseren, få umiddelbar hjelp fra en AI-veileder som er tilgjengelig døgnet rundt, og fortsett der du slapp – på nettet eller i appen.

Kurs
30
Leksjoner
120

Ofte stilte spørsmål

Er leksjonen «Spredning: varians og standardavvik» gratis?

Ja – hele teksten i «Spredning: varians og standardavvik» er gratis å lese her på nettet. For å øve interaktivt med en innebygd kodeeditor og en AI-veileder som er tilgjengelig døgnet rundt, og for å låse opp resten av Data Science Academy-kurset, kan du oppgradere til CoddyKit PRO. Kurset i Data Science Academy inneholder totalt 4 leksjoner.

Hva lærer jeg i «Spredning: varians og standardavvik»?

Hvor bredt dataene faktisk er spredt. Du øver på Data Science Academy med praktisk kode som du kjører direkte i nettleseren, mens en AI-veileder som er tilgjengelig døgnet rundt, svarer på spørsmålene dine mens du jobber deg gjennom leksjonen.

Trenger jeg erfaring for å begynne med Data Science Academy?

Ingen tidligere erfaring er nødvendig. Data Science Academy på CoddyKit er lagt opp for både nybegynnere og viderekomne, så De kan begynne her eller helt fra start og lære i Deres eget tempo. Dette er leksjon 2 av 4.

Hvor lang tid tar leksjonen «Spredning: varians og standardavvik»?

De fleste CoddyKit-leksjoner tar omtrent 5–10 minutter. Hver leksjon er kort og interaktiv, slik at De gjør jevne fremskritt og kan fortsette akkurat der De slapp – både på nettet og i appen.

Kan jeg skrive og kjøre kode i denne Data Science Academy-leksjonen?

Ja. Alle Data Science Academy-leksjoner har en innebygd kodeeditor, slik at De kan skrive og kjøre ekte kode direkte i nettleseren og få umiddelbar tilbakemelding fra AI – uten lokal konfigurering.

Alle leksjonene i dette kurset

  1. Gjennomsnitt, median og typetall
  2. Spredning: varians og standardavvik
  3. Min, maks og kvartiler
  4. Avvikere og hva de betyr
← Tilbake til Data Science Academy