Comment PCA trouve ses composantes
Comprendre intuitivement les directions de variance
Comment PCA trouve ses composantes est une leçon Data Science Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Data Science Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Data Science Academy comprend 4 leçons au total.
Certaines parties de cette leçon n'ont pas encore été traduites et s'affichent en anglais.
Variance Is Information
PCA starts from one idea: the directions where your data spreads most carry the most information. That spread is called variance.
Find the Biggest Spread
PCA hunts for the single axis along which points vary the most. That direction becomes the first principal component.
Then Go Perpendicular
The next axis must be at right angles to the first while capturing the most remaining spread. Each new component is orthogonal to the others.
Components Are New Axes
Together these directions form a fresh coordinate system. Each principal component is a blend of your original features, not just one column.
Ranked by Importance
PCA orders components by how much variance each captures, so the first few hold the bulk of the signal and the last few hold mostly noise.
Project Onto Components
To shrink your data you project it onto the top components, swapping many original columns for a few informative scores.
Explained Variance Ratio
The explained variance ratio tells you the fraction of total spread each component keeps, so you can see how much you save.
Fit It in scikit-learn
In scikit-learn you set how many components you want, then fit_transform turns your wide table into compact scores.
from sklearn.decomposition import PCA
scores = PCA(n_components=2).fit_transform(X)Read the Ratios
After fitting, check explained_variance_ratio_ to see how much each component kept. Summing them shows your total retained variance.
pca = PCA(n_components=2).fit(X)
print(pca.explained_variance_ratio_)Components Are Linear
Each component is a weighted sum of features, so PCA only captures linear structure. Curved patterns need other tools.
Compression, Not Magic
You trade a little accuracy for far fewer columns. Dropped components hold the least variance, so the loss is usually small.
Quick Check
One rule decides which direction PCA picks first.
Recap
PCA finds orthogonal axes of maximum variance, ranks them, and projects data onto the top ones to compress it. 🎯
Questions Fréquemment Posées
La leçon « Comment PCA trouve ses composantes » est-elle gratuite ?
Oui — le texte complet de « Comment PCA trouve ses composantes » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Data Science Academy, passe à CoddyKit PRO. Le cours Data Science Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Comment PCA trouve ses composantes » ?
Comprendre intuitivement les directions de variance Tu pratiques Data Science Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer Data Science Academy ?
Aucune expérience préalable n'est requise. Data Science Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.
Combien de temps prend la leçon « Comment PCA trouve ses composantes » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon Data Science Academy ?
Oui. Chaque leçon Data Science Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Le fléau d’un trop grand nombre de variables
- Comment PCA trouve ses composantes
- Mettre à l’échelle avant d’ajuster PCA
- Choisir les composantes avec un graphique des éboulis