Regex-Muster und Zeichenklassen
\d, \w, \s, ., ^, $, +, *, ?, {n,m}, Zeichenklassen [a-z], Negation [^...].
Regex-Muster und Zeichenklassen ist eine kostenlose Learn AI with Python-Lektion auf CoddyKit. Dies ist Lektion 1 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des Learn AI with Python-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der Learn AI with Python-Kurs umfasst insgesamt 4 Lektionen.
Warum reguläre Ausdrücke für Text-KI wichtig sind
Text-KI beginnt mit unordentlichem Rohtext. Reguläre Ausdrücke (Regex) sind eine kompakte Sprache zum Finden und Extrahieren von Mustern – Telefonnummern, Datumsangaben, Hashtags, URLs –, damit Sie Text bereinigen und strukturieren können, bevor Sie ihn einem Modell zuführen.
Dieser Kurs vermittelt Muster, das Modul re, Gruppen und eine echte Textbereinigungspipeline.
Literale Zeichen
Das einfachste Muster ist ein literaler Text: Es stimmt genau mit diesen Zeichen überein. Regex unterscheidet standardmäßig zwischen Groß- und Kleinschreibung.
cat findet "cat" in "the cat sat", aber nicht in "Cat".
import re
print(re.findall("cat", "the cat sat on a cat mat"))
# ["cat", "cat"]Das Punkt-Metazeichen
Der Punkt . entspricht jedem einzelnen Zeichen außer einem Zeilenumbruch. Er ist ein Platzhalter.
c.t findet "cat", "cot", "c9t" — alles mit c, einem Zeichen und anschließend t.
import re
print(re.findall("c.t", "cat cot cut c@t"))
# ["cat", "cot", "cut", "c@t"]Klassen für Ziffern, Wortzeichen und Leerraum
Kurzschreibweisen für Zeichenklassen decken häufige Gruppen ab:
\d— eine Ziffer (0-9)\w— ein Wortzeichen (Buchstabe, Ziffer oder Unterstrich)\s— Leerraum (Leerzeichen, Tabulator, Zeilenumbruch)
import re
print(re.findall("\d", "a1b2c3")) # ["1", "2", "3"]
print(re.findall("\w", "a_1!")) # ["a", "_", "1"]
print(re.findall("\s", "a b\tc")) # [" ", "\t"]Negierte Klassen
Die Großbuchstabenvarianten negieren die Klasse:
\D— alles außer einer Ziffer\W— kein Wortzeichen\S— kein Leerraum
import re
print(re.findall("\D", "a1b2")) # ["a", "b"]
print(re.findall("\S", "a b c")) # ["a", "b", "c"]Benutzerdefinierte Zeichenmengen mit [ ]
Eckige Klammern definieren eine eigene Menge: Es wird genau ein darin aufgeführtes Zeichen gefunden. Bereiche werden mit einem Bindestrich angegeben.
[aeiou]— ein beliebiger Vokal[A-Za-z]— ein beliebiger Buchstabe[0-9]— eine beliebige Ziffer (entspricht\d)
import re
print(re.findall("[A-Za-z]", "ab12CD")) # letters only
print(re.findall("[aeiou]", "hello")) # ["e", "o"]Negierte Mengen mit [^ ]
Ein Zirkumflex innerhalb der Klammern negiert die Menge: Es wird jedes Zeichen gefunden, das NICHT aufgeführt ist.
[^abc] findet alles außer a, b oder c. (Ein Zirkumflex außerhalb von Klammern ist ein Anker, der als Nächstes behandelt wird.)
import re
print(re.findall("[^aeiou ]", "hello world"))
# consonants: ["h", "l", "l", "w", "r", "l", "d"]Anker: ^ und $
Anker stimmen mit Positionen überein, nicht mit Zeichen:
^— Anfang der Zeichenkette (oder Zeile)$— Ende der Zeichenkette (oder Zeile)
^Hello findet nur dann eine Übereinstimmung, wenn der Text mit "Hello" beginnt.
import re
print(bool(re.search("^Hello", "Hello world"))) # True
print(bool(re.search("world$", "Hello world"))) # True
print(bool(re.search("^world", "Hello world"))) # FalseQuantifizierer: + * ?
Quantifizierer geben an, wie oft das vorhergehende Element wiederholt wird:
+— mindestens einmal*— null oder öfter?— null oder einmal (optional)
import re
print(re.findall("\d+", "abc 123 de 45")) # ["123", "45"]
print(re.findall("ab*", "a ab abb")) # ["a", "ab", "abb"]
print(re.findall("colou?r", "color colour")) # both matchBereichsquantifizierer {n,m}
Geschweifte Klammern geben eine exakte Anzahl oder einen Bereich an:
{3}— genau 3{2,4}— zwischen 2 und 4{2,}— 2 oder mehr
Ideal für Elemente mit fester Länge wie Postleitzahlen oder Telefonnummernabschnitte.
import re
print(re.findall("\d{3}", "12 345 6789")) # ["345", "678"]
print(re.findall("\d{2,4}", "1 22 3333 55555"))Die Teile kombinieren
Echte Muster kombinieren Klassen, Mengen, Anker und Quantifizierer. Dieses Muster findet eine einfache US-Telefonnummer wie 555-123-4567:
\d{3}-\d{3}-\d{4} — drei Ziffern, Bindestrich, drei Ziffern, Bindestrich, vier Ziffern.
import re
text = "Call 555-123-4567 or 999-888-7777"
print(re.findall("\d{3}-\d{3}-\d{4}", text))
# ["555-123-4567", "999-888-7777"]Schnelltest: Quantifizierer
Sie möchten eine oder mehrere aufeinanderfolgende Ziffern finden.
Rückblick: Muster und Zeichenklassen
Sie kennen nun die grundlegenden Bausteine von Regex:
- Literale und der
.-Platzhalter - Klassen
\d \w \sund ihre Negationen\D \W \S - Benutzerdefinierte Mengen
[A-Za-z]und negierte Mengen[^abc] - Anker
^und$ - Quantifizierer
+ * ?und Bereiche{n,m}
Als Nächstes: die Funktionen des Python-Moduls re.
Häufig gestellte Fragen
Ist die Lektion „Regex-Muster und Zeichenklassen“ kostenlos?
Ja — der vollständige Text von „Regex-Muster und Zeichenklassen“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des Learn AI with Python-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der Learn AI with Python-Kurs umfasst insgesamt 4 Lektionen.
Was lerne ich in „Regex-Muster und Zeichenklassen“?
\d, \w, \s, ., ^, $, +, *, ?, {n,m}, Zeichenklassen [a-z], Negation [^...]. Du übst Learn AI with Python mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.
Brauche ich Erfahrung, um Learn AI with Python zu starten?
Keine Vorkenntnisse erforderlich. Learn AI with Python auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 1 von 4.
Wie lange dauert die Lektion „Regex-Muster und Zeichenklassen“?
Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.
Kann ich in dieser Learn AI with Python-Lektion Code schreiben und ausführen?
Ja. Jede Learn AI with Python-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.
Alle Lektionen in diesem Kurs
- Regex-Muster und Zeichenklassen
- Modul re: search, match, findall, sub
- Capturing Groups und Named Groups
- Textbereinigung für KI mit Regex