0Pricing
Learn AI with Python · Lektion

Regex-Muster und Zeichenklassen

\d, \w, \s, ., ^, $, +, *, ?, {n,m}, Zeichenklassen [a-z], Negation [^...].

Regex-Muster und Zeichenklassen ist eine kostenlose Learn AI with Python-Lektion auf CoddyKit. Dies ist Lektion 1 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des Learn AI with Python-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der Learn AI with Python-Kurs umfasst insgesamt 4 Lektionen.

Warum reguläre Ausdrücke für Text-KI wichtig sind

Text-KI beginnt mit unordentlichem Rohtext. Reguläre Ausdrücke (Regex) sind eine kompakte Sprache zum Finden und Extrahieren von Mustern – Telefonnummern, Datumsangaben, Hashtags, URLs –, damit Sie Text bereinigen und strukturieren können, bevor Sie ihn einem Modell zuführen.

Dieser Kurs vermittelt Muster, das Modul re, Gruppen und eine echte Textbereinigungspipeline.

Literale Zeichen

Das einfachste Muster ist ein literaler Text: Es stimmt genau mit diesen Zeichen überein. Regex unterscheidet standardmäßig zwischen Groß- und Kleinschreibung.

cat findet "cat" in "the cat sat", aber nicht in "Cat".

import re

print(re.findall("cat", "the cat sat on a cat mat"))
# ["cat", "cat"]

Das Punkt-Metazeichen

Der Punkt . entspricht jedem einzelnen Zeichen außer einem Zeilenumbruch. Er ist ein Platzhalter.

c.t findet "cat", "cot", "c9t" — alles mit c, einem Zeichen und anschließend t.

import re

print(re.findall("c.t", "cat cot cut c@t"))
# ["cat", "cot", "cut", "c@t"]

Klassen für Ziffern, Wortzeichen und Leerraum

Kurzschreibweisen für Zeichenklassen decken häufige Gruppen ab:

  • \d — eine Ziffer (0-9)
  • \w — ein Wortzeichen (Buchstabe, Ziffer oder Unterstrich)
  • \s — Leerraum (Leerzeichen, Tabulator, Zeilenumbruch)
import re

print(re.findall("\d", "a1b2c3"))     # ["1", "2", "3"]
print(re.findall("\w", "a_1!"))        # ["a", "_", "1"]
print(re.findall("\s", "a b\tc"))      # [" ", "\t"]

Negierte Klassen

Die Großbuchstabenvarianten negieren die Klasse:

  • \D — alles außer einer Ziffer
  • \W — kein Wortzeichen
  • \S — kein Leerraum
import re

print(re.findall("\D", "a1b2"))   # ["a", "b"]
print(re.findall("\S", "a b c"))  # ["a", "b", "c"]

Benutzerdefinierte Zeichenmengen mit [ ]

Eckige Klammern definieren eine eigene Menge: Es wird genau ein darin aufgeführtes Zeichen gefunden. Bereiche werden mit einem Bindestrich angegeben.

  • [aeiou] — ein beliebiger Vokal
  • [A-Za-z] — ein beliebiger Buchstabe
  • [0-9] — eine beliebige Ziffer (entspricht \d)
import re

print(re.findall("[A-Za-z]", "ab12CD"))   # letters only
print(re.findall("[aeiou]", "hello"))      # ["e", "o"]

Negierte Mengen mit [^ ]

Ein Zirkumflex innerhalb der Klammern negiert die Menge: Es wird jedes Zeichen gefunden, das NICHT aufgeführt ist.

[^abc] findet alles außer a, b oder c. (Ein Zirkumflex außerhalb von Klammern ist ein Anker, der als Nächstes behandelt wird.)

import re

print(re.findall("[^aeiou ]", "hello world"))
# consonants: ["h", "l", "l", "w", "r", "l", "d"]

Anker: ^ und $

Anker stimmen mit Positionen überein, nicht mit Zeichen:

  • ^ — Anfang der Zeichenkette (oder Zeile)
  • $ — Ende der Zeichenkette (oder Zeile)

^Hello findet nur dann eine Übereinstimmung, wenn der Text mit "Hello" beginnt.

import re

print(bool(re.search("^Hello", "Hello world")))  # True
print(bool(re.search("world$", "Hello world")))  # True
print(bool(re.search("^world", "Hello world")))  # False

Quantifizierer: + * ?

Quantifizierer geben an, wie oft das vorhergehende Element wiederholt wird:

  • + — mindestens einmal
  • * — null oder öfter
  • ? — null oder einmal (optional)
import re

print(re.findall("\d+", "abc 123 de 45"))   # ["123", "45"]
print(re.findall("ab*", "a ab abb"))         # ["a", "ab", "abb"]
print(re.findall("colou?r", "color colour")) # both match

Bereichsquantifizierer {n,m}

Geschweifte Klammern geben eine exakte Anzahl oder einen Bereich an:

  • {3} — genau 3
  • {2,4} — zwischen 2 und 4
  • {2,} — 2 oder mehr

Ideal für Elemente mit fester Länge wie Postleitzahlen oder Telefonnummernabschnitte.

import re

print(re.findall("\d{3}", "12 345 6789"))    # ["345", "678"]
print(re.findall("\d{2,4}", "1 22 3333 55555"))

Die Teile kombinieren

Echte Muster kombinieren Klassen, Mengen, Anker und Quantifizierer. Dieses Muster findet eine einfache US-Telefonnummer wie 555-123-4567:

\d{3}-\d{3}-\d{4} — drei Ziffern, Bindestrich, drei Ziffern, Bindestrich, vier Ziffern.

import re

text = "Call 555-123-4567 or 999-888-7777"
print(re.findall("\d{3}-\d{3}-\d{4}", text))
# ["555-123-4567", "999-888-7777"]

Schnelltest: Quantifizierer

Sie möchten eine oder mehrere aufeinanderfolgende Ziffern finden.

Rückblick: Muster und Zeichenklassen

Sie kennen nun die grundlegenden Bausteine von Regex:

  • Literale und der .-Platzhalter
  • Klassen \d \w \s und ihre Negationen \D \W \S
  • Benutzerdefinierte Mengen [A-Za-z] und negierte Mengen [^abc]
  • Anker ^ und $
  • Quantifizierer + * ? und Bereiche {n,m}

Als Nächstes: die Funktionen des Python-Moduls re.

Häufig gestellte Fragen

Ist die Lektion „Regex-Muster und Zeichenklassen“ kostenlos?

Ja — der vollständige Text von „Regex-Muster und Zeichenklassen“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des Learn AI with Python-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der Learn AI with Python-Kurs umfasst insgesamt 4 Lektionen.

Was lerne ich in „Regex-Muster und Zeichenklassen“?

\d, \w, \s, ., ^, $, +, *, ?, {n,m}, Zeichenklassen [a-z], Negation [^...]. Du übst Learn AI with Python mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.

Brauche ich Erfahrung, um Learn AI with Python zu starten?

Keine Vorkenntnisse erforderlich. Learn AI with Python auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 1 von 4.

Wie lange dauert die Lektion „Regex-Muster und Zeichenklassen“?

Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.

Kann ich in dieser Learn AI with Python-Lektion Code schreiben und ausführen?

Ja. Jede Learn AI with Python-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.

Alle Lektionen in diesem Kurs

  1. Regex-Muster und Zeichenklassen
  2. Modul re: search, match, findall, sub
  3. Capturing Groups und Named Groups
  4. Textbereinigung für KI mit Regex
← Zurück zu Learn AI with Python