Reguläre Ausdrücke erklärt: Regex-Grundlagen, Syntax und typische Muster

Reguläre Ausdrücke – kurz Regex – wirken auf den ersten Blick wie kryptische Zeichenketten, sind aber eines der mächtigsten Werkzeuge im Umgang mit Text. Mit einem einzigen Muster findest, prüfst oder ersetzt du Daten, für die du sonst Dutzende Zeilen Code schreiben müsstest. Dieser Artikel erklärt die Grundlagen so, dass du danach deine eigenen Muster bauen kannst.

Was ein regulärer Ausdruck ist

Ein regulärer Ausdruck beschreibt ein Suchmuster für Text. Statt nach einem festen Wort zu suchen, definierst du eine Regel: „eine Ziffernfolge", „eine E-Mail-Adresse", „ein Wort, das mit Groß beginnt". Eine Regex-Engine vergleicht dieses Muster dann Zeichen für Zeichen mit deinem Text und meldet, wo es passt (ein sogenannter Match).

Regex ist nahezu überall verfügbar: in JavaScript, Python, PHP, in Editoren wie VS Code, in der Kommandozeile und in vielen Suchen-und-Ersetzen-Dialogen. Die Grundsyntax ist über diese Umgebungen hinweg weitgehend gleich. Wer ein Muster ausprobieren will, ohne gleich Code zu schreiben, kann es im Regex Match Tester direkt gegen einen Beispieltext laufen lassen und sieht sofort, welche Stellen treffen.

Die wichtigsten Bausteine

Regex besteht aus normalen Zeichen, die für sich selbst stehen, und Metazeichen mit Sonderbedeutung. Diese solltest du kennen:

Quantoren: Wie oft etwas vorkommt

Quantoren bestimmen die Wiederholung des vorangehenden Elements:

Das Muster \d{4} trifft also genau vier Ziffern in Folge – ideal für ein Jahr. \d+ trifft eine Zahl beliebiger Länge. Wichtig: Quantoren sind standardmäßig „gierig" (greedy) und nehmen so viel wie möglich. Mit einem nachgestellten ? machst du sie „genügsam" (lazy), sodass sie so wenig wie möglich greifen.

Gruppen und Flags

Mit runden Klammern (...) bildest du Gruppen. Sie fassen Teile zusammen, sodass ein Quantor auf die ganze Gruppe wirkt, und sie erlauben es, Treffer-Teile separat auszulesen – nützlich, um etwa Datum, Monat und Jahr aus einem Datumsstring zu extrahieren. Der senkrechte Strich | innerhalb einer Gruppe wirkt als Oder: (jpg|png|gif) trifft eines dieser drei Wörter.

Flags verändern das Verhalten des gesamten Ausdrucks. Die gängigsten sind i (Groß-/Kleinschreibung ignorieren), g (alle Treffer statt nur des ersten) und m (mehrzeiliger Modus, bei dem ^ und $ auf jede Zeile wirken).

Typische Muster aus der Praxis

Einige Muster begegnen dir immer wieder:

Gerade bei längeren Mustern lohnt es sich, jeden Zwischenschritt zu testen, statt blind ein komplexes Konstrukt zu bauen. Im Regex Match Tester siehst du live, wie viele Treffer ein Muster erzeugt – so erkennst du sofort, ob es zu viel oder zu wenig greift.

Häufige Fehler vermeiden

Ein klassischer Stolperstein ist der nicht maskierte Punkt: . trifft jedes Zeichen, nicht nur einen echten Punkt. Wer eine Dateiendung prüfen will, muss \. schreiben. Ebenso unterschätzt man leicht die Gier der Quantoren, die in HTML- oder Klammer-Texten viel mehr greifen als gewollt. Und nicht zuletzt gilt: Für stark verschachtelte Strukturen wie vollständiges HTML ist Regex das falsche Werkzeug – dafür gibt es echte Parser.

Wenn du ein Muster später in einem String-Literal einsetzt und Sonderzeichen wörtlich behandeln musst, hilft ein passender Escape-Schritt. Weitere Helfer rund um Text und Code findest du in der Übersicht der kostenlosen Webtools, etwa wenn du strukturierte Daten anschließend mit dem JSON Validator prüfen willst.

Fazit

Reguläre Ausdrücke sind eine Investition, die sich schnell auszahlt: Einmal verstanden, ersetzt ein einziges Muster mühsame Schleifen und Bedingungen. Bau deine Ausdrücke Schritt für Schritt auf und teste jeden davon gegen echten Text – am einfachsten mit dem Regex Match Tester, der dir Treffer und Trefferzahl sofort anzeigt.