0Pricing
NLP Academy · Lektion

Schwellenwert und Metrik auswählen

Für die für Sie wichtige Klasse optimieren

Schwellenwert und Metrik auswählen ist eine kostenlose NLP Academy-Lektion auf CoddyKit. Dies ist Lektion 3 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des NLP Academy-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der NLP Academy-Kurs umfasst insgesamt 4 Lektionen.

Teile dieser Lektion wurden noch nicht übersetzt und werden auf Englisch angezeigt.

The Hidden Threshold

Classifiers output a probability, then a threshold turns it into a label. The default 0.5 is rarely best for rare classes.

Move the Line

Lowering the threshold flags more items as the rare class, catching more true cases at the cost of extra false alarms.

Get Probabilities First

To tune a cutoff you need scores, not just labels. Ask the model for the predicted probability of the positive class.

proba = clf.predict_proba(X_test)[:, 1]

Precision or Recall?

Decide what hurts more. Missing rare cases means optimize recall; too many false alarms means favor precision.

F1 Balances Both

When you cannot pick a side, the F1 score blends precision and recall into one number worth maximizing.

The PR Curve

For skewed data the precision-recall curve tells the real story far better than an ROC curve does.

Sweep the Cutoffs

Try many cutoffs and watch how the trade-off shifts. The PR curve shows every precision-recall pair at once.

from sklearn.metrics import precision_recall_curve
p, r, t = precision_recall_curve(y, proba)

Apply Your Chosen Cutoff

Once you pick a value, compare each probability to it. Above the line becomes the positive class, below becomes negative.

preds = (proba >= 0.3).astype(int)

Beware ROC AUC

ROC AUC can look great on heavy imbalance even when precision is poor, so do not trust it alone here.

Tune on Validation Data

Choose your threshold on a held-out validation set, never on the test set, or your reported numbers will lie.

Metric Mirrors the Goal

The right metric reflects real-world cost. Let the business goal pick precision, recall, or F1, then tune to it. 🎯

Quick Check

Test your grip on thresholds.

Recap

Tune the threshold on validation data, prefer precision, recall, or F1 over accuracy, and trust the PR curve on skew. ✅

Häufig gestellte Fragen

Ist die Lektion „Schwellenwert und Metrik auswählen“ kostenlos?

Ja — der vollständige Text von „Schwellenwert und Metrik auswählen“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des NLP Academy-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der NLP Academy-Kurs umfasst insgesamt 4 Lektionen.

Was lerne ich in „Schwellenwert und Metrik auswählen“?

Für die für Sie wichtige Klasse optimieren Du übst NLP Academy mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.

Brauche ich Erfahrung, um NLP Academy zu starten?

Keine Vorkenntnisse erforderlich. NLP Academy auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 3 von 4.

Wie lange dauert die Lektion „Schwellenwert und Metrik auswählen“?

Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.

Kann ich in dieser NLP Academy-Lektion Code schreiben und ausführen?

Ja. Jede NLP Academy-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.

Alle Lektionen in diesem Kurs

  1. Warum seltene Klassen ignoriert werden
  2. Resampling und Klassengewichte
  3. Schwellenwert und Metrik auswählen
  4. End-to-End-Pipeline für unausgewogene Daten
← Zurück zu NLP Academy