0Pricing
Data Science Academy · Ders

Sayıları Ölçekleme ve Normalleştirme

Özellikleri karşılaştırılabilir bir ölçeğe getirme

Sayıları Ölçekleme ve Normalleştirme, CoddyKit'te ücretsiz bir Data Science Academy dersidir. Bu, 4 dersinin 3. dersidir. Aşağıdan dersin tamamını ücretsiz okuyabilir, sonra tarayıcıda yerleşik kod editörü ve 7/24 yapay zeka koçu ile uygulamalı olarak pratik yapabilirsin. Bu, Data Science Academy öğrenme yolunun bir parçasıdır ve ilerlemeniz web ve CoddyKit uygulaması arasında senkronize olur. Data Science Academy kursu toplamda 4 dersten oluşur.

Bu dersin bazı bölümleri henüz çevrilmemiş olup İngilizce olarak gösterilmektedir.

Why Scale Numbers

Age ranges 0 to 90 while income ranges to millions. Without scaling, the bigger numbers dominate and quietly drown out the smaller ones. ⚖️

Distance-Based Models Care

Models that measure distance, like k-NN and k-means, are very sensitive to scale. Unscaled features hand all the power to the largest column.

Standardization

Standardization rescales a column to mean 0 and standard deviation 1. Values become how many standard deviations they sit from the average.

StandardScaler

The StandardScaler applies standardization for you. Fit it on your data, then transform any column into z-scores.

from sklearn.preprocessing import StandardScaler
z = StandardScaler().fit_transform(df[['age']])

Normalization

Normalization squeezes values into a fixed range, usually 0 to 1. The smallest value maps to 0 and the largest to 1.

MinMaxScaler

Reach for MinMaxScaler to rescale into 0 to 1. It keeps the shape of your data while bounding the range.

from sklearn.preprocessing import MinMaxScaler
m = MinMaxScaler().fit_transform(df[['age']])

Standardize or Normalize

Use standardization when data is roughly bell-shaped or has outliers. Pick normalization when you need a strict 0 to 1 bound.

Outliers Hurt MinMax

A single huge value can squash everything else near zero under MinMax. When outliers dominate, RobustScaler resists them better.

from sklearn.preprocessing import RobustScaler
r = RobustScaler().fit_transform(df[['income']])

Fit on Train Only

Fit the scaler on training data alone, then transform the test set. Fitting on everything leaks test information into your model.

scaler.fit(X_train)
X_test_scaled = scaler.transform(X_test)

Scale Inside a Pipeline

Bundle the scaler with your model in a Pipeline. It then fits only on the training fold during cross-validation, blocking leakage for free.

from sklearn.pipeline import make_pipeline
pipe = make_pipeline(StandardScaler(), model)

Trees Do Not Need It

Tree-based models like random forests split on thresholds, so scaling rarely changes results. Save scaling for distance and linear methods.

Quick Check

You need every feature rescaled to a strict 0-to-1 range. Which scaler fits?

Recap: Scaling

You put features on a fair footing: StandardScaler for z-scores, MinMaxScaler for 0 to 1, RobustScaler for outliers. Always fit on train only. 🎉

Sıkça Sorulan Sorular

“Sayıları Ölçekleme ve Normalleştirme” dersi ücretsiz mi?

Evet — “Sayıları Ölçekleme ve Normalleştirme” dersin tüm metni burada web'de ücretsiz olarak okunabilir. Etkileşimli olarak pratik yapmak (yerleşik kod editörü ve 7/24 yapay zeka koçu) ve Data Science Academy kursunun geri kalanını açmak için CoddyKit PRO'ya yükselt. Data Science Academy kursu toplamda 4 dersten oluşur.

“Sayıları Ölçekleme ve Normalleştirme” dersinde ne öğreneceğim?

Özellikleri karşılaştırılabilir bir ölçeğe getirme Data Science Academy ile uygulamalı kodu tarayıcıda doğrudan çalıştırarak pratik yaparsın ve 7/24 yapay zeka koçu dersi çalışırken sorularını yanıtlar.

Data Science Academy öğrenmeye başlamak için deneyim gerekli mi?

Önceden deneyim gerekmez. CoddyKit'te Data Science Academy, başlangıçtan ileri seviyeye kadar yapılandırıldığı için buradan başlayabilir veya başından başlayıp kendi hızında ilerleme yapabilirsin. Bu, 4 dersinin 3. dersidir.

“Sayıları Ölçekleme ve Normalleştirme” dersi ne kadar sürer?

Çoğu CoddyKit dersi yaklaşık 5–10 dakika sürer. Her biri kısa ve etkileşimli olduğu için sabit ilerleme yaparsın ve web ile uygulama arasında tam olarak bıraktığın yerden devam edebilirsin.

Bu Data Science Academy dersinde kod yazıp çalıştırabilir miyim?

Evet. Her Data Science Academy dersi yerleşik bir kod editörü içerir, bu sayede tarayıcıda gerçek kod yazıp çalıştırabilir ve anlık yapay zeka geri bildirimi alırsın — yerel kurulum gerekli değildir.

Bu kursun tüm dersleri

  1. Sayıları Kategorilere Ayırma
  2. Kategorik Sütunları Kodlama
  3. Sayıları Ölçekleme ve Normalleştirme
  4. Tarihlerden ve Metinlerden Özellik Oluşturma
← Data Science Academy Sayfasına Dön