NumPy-grundlag: Arrays og matematiske operationer
Opret og manipulér NumPy-arrays, udfør vektoriseret aritmetik, og forstå broadcasting, så De kan håndtere numeriske data effektivt.
NumPy-grundlag: Arrays og matematiske operationer er en gratis Machine Learning Academy-lektion på CoddyKit. Dette er lektion 2 af 4. Du kan læse hele lektionen gratis nedenfor — og derefter øve dig praktisk i browseren med en indbygget kodeeditor og en AI-vejleder, der er tilgængelig døgnet rundt. Den er en del af læringsforløbet i Machine Learning Academy, og dine fremskridt synkroniseres på tværs af nettet og CoddyKit-appen. Machine Learning Academy-kurset indeholder 4 lektioner i alt.
Hvorfor NumPy er grundlaget for ML
NumPy er grundlaget under alle ML-biblioteker. Dets superkraft er vektoriseret matematik: det arbejder på hele arrays på én gang i hurtig C-kode, så Python-løkker bliver efterladt i støvet.
import numpy as np
import time
# Speed comparison: NumPy vs Python list
n = 1_000_000
python_list = list(range(n))
np_array = np.arange(n)
# Python loop (slow)
start = time.time()
result = [x * 2 for x in python_list]
print(f'Python loop: {time.time() - start:.3f}s')
# NumPy vectorised (fast)
start = time.time()
result = np_array * 2
print(f'NumPy vectorised: {time.time() - start:.4f}s')Oprettelse af NumPy-arrays
Det centrale NumPy-objekt er arrayet. Dets vigtigste egenskab er shape — en tupel, der angiver størrelsen på hver dimension, f.eks. (rækker, kolonner). Koden viser, hvordan du opretter dem.
import numpy as np
# From Python list
a = np.array([1, 2, 3, 4, 5])
print('1D array:', a, '| shape:', a.shape) # (5,)
# 2D matrix from nested list
M = np.array([[1, 2, 3], [4, 5, 6]])
print('2D matrix shape:', M.shape) # (2, 3)
# Built-in generators
zeros = np.zeros((3, 4)) # 3x4 matrix of zeros
ones = np.ones((2, 5)) # 2x5 matrix of ones
range_arr = np.arange(0, 10, 2) # [0 2 4 6 8]
linspace = np.linspace(0, 1, 5) # 5 evenly spaced points
random = np.random.randn(3, 3) # 3x3 standard normalIndeksering og udsnit af arrays
Du indekserer arrays med [række, kolonne] og laver udsnit med start:stop:step. En vigtig detalje er, at et udsnit er en visning og ikke en kopi — hvis du ændrer det, ændrer du originalen. Brug .copy() for at være sikker.
import numpy as np
M = np.array([[1, 2, 3, 4],
[5, 6, 7, 8],
[9, 10, 11, 12]])
# Single element
print(M[1, 2]) # 7 (row 1, column 2)
# Slice rows and columns
print(M[0:2, 1:3]) # rows 0-1, columns 1-2 -> [[2,3],[6,7]]
# All rows, last column
print(M[:, -1]) # [4, 8, 12]
# Boolean indexing
print(M[M > 6]) # [7, 8, 9, 10, 11, 12]Vektoriserede aritmetiske operationer
NumPy-matematik er som standard elementvis: a + b lægger tilsvarende elementer sammen uden en løkke. Det kører i kompileret C, og derfor går det stærkt på millioner af tal. Se koden.
import numpy as np
a = np.array([1.0, 2.0, 3.0, 4.0])
b = np.array([10.0, 20.0, 30.0, 40.0])
print('Addition:', a + b) # [11. 22. 33. 44.]
print('Multiply:', a * b) # [10. 40. 90. 160.]
print('Power:', a ** 2) # [ 1. 4. 9. 16.]
print('Divide:', b / a) # [10. 10. 10. 10.]
# Scalar operations apply to all elements
print('Add scalar:', a + 100) # [101. 102. 103. 104.]
print('Square root:', np.sqrt(a)) # [1. 1.41 1.73 2.]Broadcasting: arbejde med forskellige former
Broadcasting lader NumPy kombinere forskellige former ved at udvide den mindste, så den passer. Det er sådan, du føjer en bias-vektor til et helt batch uden at skrive løkker.
import numpy as np
# Matrix + vector (broadcasting)
matrix = np.array([[1, 2, 3],
[4, 5, 6],
[7, 8, 9]]) # shape (3, 3)
bias = np.array([10, 20, 30]) # shape (3,) -> broadcasts to (3, 3)
result = matrix + bias
print(result)
# [[11 22 33]
# [14 25 36]
# [17 28 39]]
# Normalize each column to zero mean (ML preprocessing)
mean = matrix.mean(axis=0) # shape (3,)
centered = matrix - mean # broadcasts across rowsAggregeringsfunktioner
Aggregeringer som middelværdi og sum reducerer et array. axis vælger retningen: axis=0 går ned gennem kolonnerne, og axis=1 går hen over rækkerne. Koden viser begge dele.
import numpy as np
X = np.array([[1, 2, 3],
[4, 5, 6],
[7, 8, 9]], dtype=float)
print('Global mean:', X.mean()) # 5.0
print('Column means:', X.mean(axis=0)) # [4. 5. 6.]
print('Row means:', X.mean(axis=1)) # [2. 5. 8.]
print('Global std:', X.std()) # ~2.58
print('Column max:', X.max(axis=0)) # [7. 8. 9.]
print('Row sum:', X.sum(axis=1)) # [ 6. 15. 24.]Matrixmultiplikation: ML's hjerte
Matrixmultiplikation er kernen i ML — hvert lag i et neuralt netværk og hver forudsigelse bruger den. Brug @ (ikke *, som er elementvis). De indre former skal passe sammen: (m,k) ganget med (k,n).
import numpy as np
# Linear regression prediction: y_hat = X @ weights + bias
X = np.random.randn(100, 5) # 100 samples, 5 features
weights = np.random.randn(5) # one weight per feature
bias = 0.5
y_hat = X @ weights + bias # shape: (100,)
print('Predictions shape:', y_hat.shape)
# Matrix-matrix multiplication (e.g., two weight layers)
A = np.random.randn(4, 3) # (4, 3)
B = np.random.randn(3, 5) # (3, 5)
C = A @ B # (4, 5)
print('A @ B shape:', C.shape)Ændring af form og sammenkædning af arrays
Ændring af form ændrer et arrays form uden at røre dets data — som at omdanne et billede på 28x28 til 784 tal. Sammenkædning med vstack eller hstack føjer arrays sammen.
import numpy as np
# Reshape: 1D to 2D
a = np.arange(12) # [0, 1, ..., 11]
matrix = a.reshape(3, 4) # shape (3, 4)
print('Reshaped:', matrix.shape)
# Use -1 to infer one dimension automatically
flat = matrix.reshape(-1) # back to 1D (12,)
row = matrix.reshape(1, -1) # shape (1, 12)
col = matrix.reshape(-1, 1) # shape (12, 1)
# Stack two arrays row-wise
A = np.array([[1, 2], [3, 4]])
B = np.array([[5, 6], [7, 8]])
stacked = np.vstack([A, B]) # shape (4, 2)Generering af tilfældige tal til ML
Tilfældige tal bruges til initialisering af vægte, blanding og opdeling i trænings- og testdata. Sæt altid et seed, så resultaterne kan gentages — uden det bliver hvert kørselsresultat forskelligt, og fejlfinding bliver besværlig.
import numpy as np
# Set seed for reproducibility
rng = np.random.default_rng(seed=42)
# Common distributions used in ML
uniform = rng.uniform(0, 1, size=(3, 3)) # Uniform [0, 1)
normal = rng.normal(0, 1, size=(3, 3)) # Standard normal
integers = rng.integers(0, 10, size=5) # Random integers
# Shuffle an array
data = np.arange(10)
rng.shuffle(data)
print('Shuffled:', data)
# Random sampling without replacement
idxs = rng.choice(100, size=20, replace=False) # 20 unique indicesBooleske masker og avanceret indeksering
Boolesk maskering filtrerer arrays på én enkel linje: sammenlign med en betingelse, og vælg derefter de elementer, der matcher. Avanceret indeksering vælger elementer ud fra en eksplicit liste over positioner.
import numpy as np
scores = np.array([85, 42, 91, 67, 55, 78, 33, 95])
# Boolean mask: select scores above 70
mask = scores > 70
print('Mask:', mask) # [T F T F F T F T]
print('High scores:', scores[mask]) # [85 91 78 95]
# Count how many passed
print('Passed:', mask.sum()) # 4
# Fancy indexing: select by explicit indices
indices = np.array([0, 2, 7])
print('Selected:', scores[indices]) # [85 91 95]
# Replace outliers
scores[scores < 50] = 50 # clip low scores to 50NumPy i arbejdsgange med scikit-learn
scikit-learn kræver de rigtige former: X som 2D (samples, features) og y som 1D (samples). En form som (100,) i stedet for (100, 1) er en klassisk fejl — reshape(-1, 1) løser den.
import numpy as np
from sklearn.linear_model import LinearRegression
# X must be 2D: (n_samples, n_features)
X = np.array([1, 2, 3, 4, 5]) # shape (5,) -- WRONG
# Fix:
X = X.reshape(-1, 1) # shape (5, 1) -- CORRECT
y = np.array([2.1, 4.0, 5.9, 8.1, 10.0]) # shape (5,) -- correct
model = LinearRegression()
model.fit(X, y)
print('Learned slope:', round(model.coef_[0], 2)) # ~2.0Hurtig kontrol
Test din forståelse af begreberne inden for Machine Learning med Python fra denne lektion.
Opsummering af lektionen
Du har lært det grundlæggende i NumPy: arrays ligger til grund for al ML, vektoriseret matematik og broadcasting eliminerer langsomme løkker, og @-operatoren bruges af alle modeller. Næste emne: Pandas. 🐼
Lær Python med en AI-underviser — gratis
Skriv og kør rigtig kode i din browser, få øjeblikkelig hjælp fra en AI-underviser døgnet rundt, og fortsæt, hvor du slap, på web eller i appen.
- Kurser
- 30
- Lektioner
- 120
Ofte stillede spørgsmål
Er lektionen “NumPy-grundlag: Arrays og matematiske operationer” gratis?
Ja — hele teksten til “NumPy-grundlag: Arrays og matematiske operationer” kan læses gratis her på nettet. Hvis du vil øve dig interaktivt med en indbygget kodeeditor og en AI-vejleder døgnet rundt og få adgang til resten af Machine Learning Academy-kurset, skal du opgradere til CoddyKit PRO. Machine Learning Academy-kurset indeholder 4 lektioner i alt.
Hvad lærer jeg i “NumPy-grundlag: Arrays og matematiske operationer”?
Opret og manipulér NumPy-arrays, udfør vektoriseret aritmetik, og forstå broadcasting, så De kan håndtere numeriske data effektivt. Du øver dig i Machine Learning Academy med praktisk kode, som du kører direkte i browseren, og en AI-vejleder døgnet rundt besvarer dine spørgsmål, mens du arbejder dig gennem lektionen.
Skal jeg have erfaring for at begynde på Machine Learning Academy?
Der kræves ingen tidligere erfaring. Machine Learning Academy på CoddyKit er tilrettelagt for både begyndere og øvede, så du kan starte her eller fra begyndelsen og lære i dit eget tempo. Dette er lektion 2 af 4.
Hvor lang tid tager lektionen “NumPy-grundlag: Arrays og matematiske operationer”?
De fleste CoddyKit-lektioner tager cirka 5–10 minutter. Hver lektion er kort og interaktiv, så du gør løbende fremskridt og kan fortsætte, hvor du slap – på både web og app.
Kan jeg skrive og køre kode i denne Machine Learning Academy-lektion?
Ja. Alle Machine Learning Academy-lektioner har en indbygget kodeeditor, så du kan skrive og køre rigtig kode direkte i din browser og få øjeblikkelig feedback fra AI – uden lokal opsætning.
Alle lektioner i dette kursus
- Installation af Anaconda og Jupyter Notebook
- NumPy-grundlag: Arrays og matematiske operationer
- Pandas til datamanipulation
- Visualisering af data med Matplotlib og Seaborn