Regex Cheatsheet – die wichtigsten Muster mit Beispielen
Alle wichtigen Regex-Muster auf einen Blick: Zeichenklassen, Quantoren, Anker, Lookarounds und fertige Patterns für E-Mail, URL und mehr.
Reguläre Ausdrücke (Regex) gehören zu den mächtigsten Werkzeugen für Textverarbeitung – aber auch zu den kryptischsten. Dieses Cheatsheet fasst die wichtigsten Bausteine zusammen, mit Beispielen, die Du direkt kopieren und in unserem Regex-Tester ausprobieren kannst.
Zeichenklassen
Zeichenklassen matchen genau ein Zeichen aus einer definierten Menge. Sie sind das Fundament fast jeder Regex.
| Symbol | Bedeutung | Beispiel |
|---|---|---|
\d | Ziffer 0–9 | \d{3} matcht 123 |
\D | Keine Ziffer | \D+ matcht abc |
\w | Wortzeichen (a-z, A-Z, 0-9, _) | \w+ matcht hello_42 |
\W | Nicht-Wortzeichen | matcht z.B. Leerzeichen, Komma |
\s | Whitespace (Space, Tab, Newline) | \s+ |
\S | Kein Whitespace | |
[a-z] | Range Kleinbuchstaben | [a-zA-Z0-9] |
[^abc] | Negation: nicht a, b oder c | |
. | Beliebiges Zeichen (außer Newline) | |
\. | Wörtlicher Punkt |
Quantoren
Quantoren legen fest, wie oft das vorhergehende Element auftauchen darf.
*– 0 oder mehr+– 1 oder mehr?– 0 oder 1 (optional){n}– exakt n mal{n,m}– zwischen n und m mal{n,}– mindestens n mal
Quantoren sind standardmäßig greedy und matchen so viel wie möglich. Mit nachgestelltem? werden sie lazy: a.+?b matcht das kürzeste a...b, statt das längste.
Anker und Wortgrenzen
^– Anfang der Zeile/des Strings$– Ende der Zeile/des Strings\b– Wortgrenze (zwischen\wund\W)\B– keine Wortgrenze
Mit dem Multiline-Flag m matchen ^ und $ jede Zeile statt nur den gesamten String.
Gruppen, Alternativen und Lookarounds
Runde Klammern ( ... ) bilden eine Capturing Group. Mit(?: ... ) bekommst Du eine Non-Capturing Group – schneller und sauberer, wenn Du den Match nicht zurückbrauchst. Alternativen trennst Du mit |:cat|dog.
Lookarounds
(?=...)– Positive Lookahead: matcht nur, wenn ... folgt(?!...)– Negative Lookahead: matcht nur, wenn ... nicht folgt(?<=...)– Positive Lookbehind(?<!...)– Negative Lookbehind
Praxis-Patterns zum Kopieren
# E-Mail (vereinfacht, RFC-konform ist viel länger)
^[\w.+-]+@[\w-]+\.[a-zA-Z]{2,}$
# URL (http/https)
^https?://[\w.-]+(?::\d+)?(?:/[^\s]*)?$
# IPv4
^((25[0-5]|2[0-4]\d|[01]?\d\d?)\.){3}(25[0-5]|2[0-4]\d|[01]?\d\d?)$
# ISO-Datum YYYY-MM-DD
^\d{4}-(0[1-9]|1[0-2])-(0[1-9]|[12]\d|3[01])$
# Deutsche PLZ
^\d{5}$
# US ZIP (5 oder 5+4)
^\d{5}(-\d{4})?$Engine-Unterschiede
Achtung: Nicht jede Regex-Engine ist gleich. JavaScript unterstützt seit ES2018 Lookbehinds, ältere Browser nicht. Go (RE2) verzichtet auf Backreferences und Lookarounds zugunsten linearer Laufzeit. Python kennt zusätzlich re.VERBOSE für lesbare Patterns. Im Zweifel: testen, nicht raten.