0Pricing
Data Science Academy · Lektion

Klassengewichte und Schwellenwerte

Das Modell auf die Minderheitsklasse ausrichten

Klassengewichte und Schwellenwerte ist eine kostenlose Data Science Academy-Lektion auf CoddyKit. Dies ist Lektion 3 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des Data Science Academy-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der Data Science Academy-Kurs umfasst insgesamt 4 Lektionen.

Teile dieser Lektion wurden noch nicht übersetzt und werden auf Englisch angezeigt.

Fix It Without Resampling

You can fight imbalance without touching the data at all. Two model-side levers help: class weights and the decision threshold.

What Class Weights Do

Class weights tell the model that mistakes on the rare class hurt more. It pays a bigger penalty for missing minority rows.

The Easy Default

Many scikit-learn models accept class_weight set to balanced. It auto-weights each class inversely to how often it appears.

model = LogisticRegression(class_weight='balanced')
model.fit(X_train, y_train)

Weights vs Resampling

Class weights reshape the loss instead of the dataset. No rows are added or dropped, so you keep all your original data.

The Hidden 0.5 Cutoff

Most classifiers predict a probability, then label it positive if it tops 0.5. That default cutoff is a choice, not a law.

Move the Threshold

Lower the threshold and the model flags positives more eagerly. That catches more rare cases, at the price of more false alarms.

Predict Probabilities First

To tune a threshold, ask the model for probabilities, not hard labels. Then apply your own cutoff to those scores.

proba = model.predict_proba(X_test)[:, 1]
preds = (proba >= 0.30).astype(int)

The Core Trade-Off

A lower threshold lifts recall but drops precision. Raising it does the reverse. The right point depends on which mistake costs more.

Let Cost Drive the Cutoff

If a missed fraud is far worse than a false alarm, lean toward a lower threshold so the rare class is rarely missed.

Combine the Levers

Class weights and threshold tuning stack nicely. Weight the rare class during training, then pick a cutoff that matches your real costs.

Tune, Then Lock It In

Choose the threshold using validation data, never the test set. Then apply that same fixed cutoff for an honest final score.

Quick Check

What happens when you lower the decision threshold?

Recap

Without resampling, class weights penalize rare-class errors and a tuned threshold trades recall against precision to fit your costs. 🎯

Häufig gestellte Fragen

Ist die Lektion „Klassengewichte und Schwellenwerte“ kostenlos?

Ja — der vollständige Text von „Klassengewichte und Schwellenwerte“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des Data Science Academy-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der Data Science Academy-Kurs umfasst insgesamt 4 Lektionen.

Was lerne ich in „Klassengewichte und Schwellenwerte“?

Das Modell auf die Minderheitsklasse ausrichten Du übst Data Science Academy mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.

Brauche ich Erfahrung, um Data Science Academy zu starten?

Keine Vorkenntnisse erforderlich. Data Science Academy auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 3 von 4.

Wie lange dauert die Lektion „Klassengewichte und Schwellenwerte“?

Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.

Kann ich in dieser Data Science Academy-Lektion Code schreiben und ausführen?

Ja. Jede Data Science Academy-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.

Alle Lektionen in diesem Kurs

  1. Warum Accuracy bei unausgeglichenen Daten täuscht
  2. Resampling: SMOTE und Undersampling
  3. Klassengewichte und Schwellenwerte
  4. Metriken für seltene Ereignisse auswählen
← Zurück zu Data Science Academy