0Pricing
Data Science Academy · Lezione

Come PCA trova le componenti

Le direzioni della varianza, in modo intuitivo.

Come PCA trova le componenti è una lezione Data Science Academy gratuita su CoddyKit. Questa è la lezione 2 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Data Science Academy, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Data Science Academy include 4 lezioni in totale.

Parti di questa lezione non sono ancora state tradotte e vengono mostrate in inglese.

Variance Is Information

PCA starts from one idea: the directions where your data spreads most carry the most information. That spread is called variance.

Find the Biggest Spread

PCA hunts for the single axis along which points vary the most. That direction becomes the first principal component.

Then Go Perpendicular

The next axis must be at right angles to the first while capturing the most remaining spread. Each new component is orthogonal to the others.

Components Are New Axes

Together these directions form a fresh coordinate system. Each principal component is a blend of your original features, not just one column.

Ranked by Importance

PCA orders components by how much variance each captures, so the first few hold the bulk of the signal and the last few hold mostly noise.

Project Onto Components

To shrink your data you project it onto the top components, swapping many original columns for a few informative scores.

Explained Variance Ratio

The explained variance ratio tells you the fraction of total spread each component keeps, so you can see how much you save.

Fit It in scikit-learn

In scikit-learn you set how many components you want, then fit_transform turns your wide table into compact scores.

from sklearn.decomposition import PCA
scores = PCA(n_components=2).fit_transform(X)

Read the Ratios

After fitting, check explained_variance_ratio_ to see how much each component kept. Summing them shows your total retained variance.

pca = PCA(n_components=2).fit(X)
print(pca.explained_variance_ratio_)

Components Are Linear

Each component is a weighted sum of features, so PCA only captures linear structure. Curved patterns need other tools.

Compression, Not Magic

You trade a little accuracy for far fewer columns. Dropped components hold the least variance, so the loss is usually small.

Quick Check

One rule decides which direction PCA picks first.

Recap

PCA finds orthogonal axes of maximum variance, ranks them, and projects data onto the top ones to compress it. 🎯

Domande Frequenti

La lezione «Come PCA trova le componenti» è gratuita?

Sì — il testo completo di «Come PCA trova le componenti» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Data Science Academy, passa a CoddyKit PRO. Il corso Data Science Academy include 4 lezioni in totale.

Cosa imparerò in «Come PCA trova le componenti»?

Le direzioni della varianza, in modo intuitivo. Eserciti Data Science Academy con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare Data Science Academy?

Non è richiesta alcuna esperienza precedente. Data Science Academy su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 2 di 4.

Quanto tempo richiede la lezione «Come PCA trova le componenti»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione Data Science Academy?

Sì. Ogni lezione Data Science Academy include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. La maledizione delle troppe feature
  2. Come PCA trova le componenti
  3. Scalare prima, adattare PCA dopo
  4. Scegliere le componenti con gli scree plot
← Torna a Data Science Academy