Datasett som liste av ordbøker
Et datasett er en tabell: hver rad er en post, hver kolonne er et felt. I Python representerer vi det som en liste av ordbøker — én ordbok per rad, der nøklene er feltnavnene. Da kan vi gå gjennom postene med en løkke og hente felt med post[felt].
Slik kan du tenke om det
- To lag: indeks, så nøkkel Et datasett er en liste av ordbøker: lista er alle postene, og hver ordbok er én post der feltnavnene er nøkler. Derfor er data[0]["navn"] to oppslag etter hverandre — først [0] for første post, så ["navn"] for feltet i den.
Vanlige feil
- Du tror tall fra en CSV er tall Når en CSV inneholder «17», ser det ut som et tall. Men csv.DictReader gir ALT som strenger — også tall. «17» + 1 gir derfor en feil. Skal du regne, må du først gjøre verdien om med int(...) eller float(...).
Øv på dette
- Flervalg: hvordan lagrer vi et datasett?
- Herme: les og skriv ut datasettet
- Sjekk: hvilken type har verdien?
- Utvide: hent ut én kolonne
- Øving: filtrer et datasett
- Sjekk: hvorfor krasjer summen?
- Hvor har du sett en tabell før?
- Begrepssjekk: Fra fil til datasett
- Drill: Datasett — øvet
- Lage: filtrer datasettet
- To design for et datasett: liste-av-ordbøker eller parallelle lister?