Kostenlos - Ohne Anmeldung

Robots.txt Validator

Debuggen Sie Crawl-Zugriffe, bevor Googlebot ein Problem findet. Geben Sie eine Domain, einen Pfad und einen Crawler-User-Agent ein, um zu prüfen, ob robots.txt die URL zulässt, welche Regel passt und ob Sitemap-Direktiven vorhanden sind.

So funktioniert es

Ein kurzer, klarer Ablauf — eingeben, ausführen, Ergebnis lesen.

  1. Domain eingeben

    Fügen Sie die zu testende Website ein. Wir rufen /robots.txt von dieser Domain ab.

  2. Pfad und Bot auswählen

    Geben Sie einen URL-Pfad und einen User-Agent wie Googlebot, Bingbot oder * ein.

  3. Passende Regel ablesen

    Sehen Sie die Allow/Block-Entscheidung, die passende Regel, Sitemap-Direktiven und mögliche Syntaxwarnungen.

Was ist robots.txt, und warum blockiert eine einzige Disallow-Regel Ihre gesamte Website?

Robots.txt ist eine einfache Textdatei im Root-Verzeichnis Ihrer Domain, die Crawlern mitteilt, welche Pfade sie abrufen dürfen. Eine einzige falsch platzierte Disallow-Regel oder eine fehlende neue Zeile am Ende der Datei kann über Nacht Tausende von URLs aus dem Index entfernen.

Robots.txt ist die erste Datei, die Googlebot anfordert, wenn er eine neue Domain besucht. Die Datei besteht aus User-Agent-Blöcken, gefolgt von Allow- und Disallow-Direktiven. Google analysiert sie bei jedem Crawl, gleicht jede URL, die abgerufen werden soll, mit den Regeln für den jeweiligen User-Agent ab und überspringt alle Pfade, die blockiert sind. Die Datei ist case-sensitiv, pfadbasiert und unterstützt keine Wildcards in der Weise, wie die meisten Nutzer es erwarten.Die Risiken sind bekannt und dennoch überraschend häufig. Ein Entwickler fügt Disallow: / hinzu, um einen Staging-Ordner zu blockieren, und vergisst, die Regel einzuschränken. Ein CMS-Rewrite fügt eine Disallow: /-Zeile hinzu, die die gesamte Website blockiert. Eine fehlende neue Zeile nach der letzten Direktive führt dazu, dass Google die letzte Regel mit der Kopfzeile der nächsten Gruppe zusammenführt. Jedes dieser Probleme blockiert das Crawling, ohne jemals einen Serverfehler auszulösen, sodass das einzige Signal ein stiller Rückgang des organischen Traffics Wochen später ist.Unser Robots.txt Validator ruft Ihre Datei ab und testet jeden URL-Pfad gegen jeden User-Agent (Googlebot, Bingbot, GPTBot, *). Sie sehen die Allow- oder Block-Entscheidung, die spezifische Zeile, die passt, die längste passende Regel, die Google anwenden würde, und alle Syntaxwarnungen zu nicht unterstützten Direktiven. Fügen Sie eine Domain und einen Pfad ein, erhalten Sie die Antwort in unter einer Sekunde und setzen Sie die Korrektur um.
1
Robots.txt-Datei pro Domain unter /robots.txt
500
Kilobyte weiche Obergrenze, die Google für die Dateigröße durchsetzt
0
Robots.txt verhindert nicht allein die Indexierung

Was dieser robots.txt Validator prüft

Jede Direktive, Syntaxregel und jeden User-Agent-Block, der beeinflusst, ob Crawler Ihre Seiten abrufen können.

  • User-agent groupsanalysiert die User-Agent-Zeilen und gruppiert die passenden Allow- und Disallow-Direktiven. Wildcards wie * und benannte Bots wie Googlebot werden beide getestet.
  • Disallow rulesbewertet jede Disallow-Pfadangabe mit Berücksichtigung von Groß- und Kleinschreibung sowie abschließenden Schrägstrichen, die häufigste Ursache für falsche Blockierungen.
  • Allow rulesberücksichtigt Allow-Ausnahmen, die eine breitere Disallow-Regel überschreiben. Erforderlich, wenn Sie einen Unterordner innerhalb eines blockierten Verzeichnisses freigeben möchten.
  • Sitemap directivekennzeichnet fehlende oder fehlerhafte Sitemap:-Zeilen. Mehrere Sitemaps sollten jeweils eine eigene Zeile erhalten und absolute URLs verwenden.
  • Path matching testerermöglicht das Testen jedes URL-Pfads gegen die analysierten Regeln. Gibt die passende Direktive und die resultierende Allow- oder Block-Entscheidung zurück.
  • Crawl-delay warningsidentifiziert Crawl-delay-Direktiven. Google ignoriert diese Zeile, sodass sie den meisten Teams ein falsches Gefühl von Kontrolle über die Crawl-Geschwindigkeit vermittelt.
  • Syntax error scanerkennt nicht unterstützte Direktiven (noindex, host), fehlerhafte Regex und fehlende neue Zeilen, die Regeln in die falsche Gruppe verschieben.
  • LLM crawler supporttestet Regeln gegen GPTBot, ClaudeBot, PerplexityBot und andere KI-Crawler, sodass Sie diese gezielt zulassen oder blockieren können.

Wer nutzt diesen robots.txt Validator

Teams, die genau wissen müssen, welche Crawler welche Pfade abrufen können, bevor der Traffic einbricht.

In-house SEOs

Ihr CMS generiert automatisch /robots.txt, und Sie möchten überprüfen, ob der Staging-Ordner tatsächlich für Googlebot blockiert ist, bevor der nächste Push erfolgt.

Testen Sie den Staging-Pfad in 5 Sekunden gegen Googlebot, bestätigen Sie die Disallow-Regel und sparen Sie sich das manuelle Durchsuchen von 200 Konfigurationszeilen.

Entwickler

Sie haben um 2 Uhr morgens eine neue Sitemap-Direktive veröffentlicht und möchten bestätigen, dass die Syntax korrekt ist und die Datei als text/plain ausgeliefert wird.

Validieren Sie die Datei mit einem Klick, sehen Sie das analysierte Ergebnis und erkennen Sie die fehlende neue Zeile, bevor sie eine Warnung in der Google Search Console auslöst.

Agenturen

Sie verwalten 30 Kundendomains und benötigen eine schnelle Möglichkeit, die robots.txt jeder Domain vor einem vierteljährlichen Audit zu prüfen.

Führen Sie jede Domain in unter einer Minute durch, markieren Sie diejenigen mit Disallow: / oder fehlenden Sitemap-Zeilen und senden Sie eine Liste mit Korrekturen an das Entwicklungsteam.

Migrationsverantwortliche

Sie migrieren eine Website zu einem neuen CMS, und die neue Vorlage enthält eine robots.txt, die /wp-admin blockiert. Sie müssen bestätigen, dass die alten Pfade weiterhin funktionieren.

Testen Sie die alten URL-Pfade gegen die neue Datei, bestätigen Sie, dass die Allow-Ausnahmen die Migration überstanden haben, und setzen Sie die Änderungen mit Zuversicht um.

E-Commerce-Manager

Sie haben 4.000 Facetten-Navigations-URLs hinzugefügt und möchten diese für Googlebot blockieren, ohne versehentlich die Kategorieseiten zu sperren.

Testen Sie jeden Facetten-Pfad, sehen Sie die passende Regel und passen Sie die Regex an, bis nur die gewünschten URLs blockiert sind.

KI-SEO-Verantwortliche

Sie möchten, dass GPTBot und ClaudeBot Ihre Dokumentation lesen, aber die Preisseite nicht indexieren. Sie müssen die Regeln für jeden Bot testen.

Führen Sie den Validator für jeden KI-User-Agent aus, sehen Sie die Allow- oder Block-Entscheidung pro Pfad und setzen Sie die Regeln um, die Ihrer Richtlinie entsprechen.

Verwandte Glossarbegriffe

Sie möchten tiefer einsteigen? Diese Glossareinträge erklären die Konzepte hinter diesem Tool.

Häufig gestellte
Fragen

Alles Wissenswerte rund um Robots.txt Validator und technisches SEO.

Der Robots.txt Validator hilft SEOs, einen spezifischen technischen SEO-Workflow direkt im Browser zu diagnostizieren. Er ist für schnelle Audits, QA-Prüfungen und Vorab-Validierungen konzipiert.

Ja. Das Tool kann auf SERPView ohne Registrierung kostenlos genutzt werden. URL-Abfrage-Tools verwenden konservative Limits, um die Prüfungen schnell und respektvoll durchzuführen.

Nein. Das Tool ruft die URL für die aktuelle Analyse ab und gibt das Ergebnis zurück. Wir speichern keine Seiteninhalte und verwenden geprüfte Seiten nicht für Trainingszwecke.

Verwenden Sie es während technischer SEO-Audits, bei Site-Launches, Migrationen, Content-QA oder immer dann, wenn eine Seite sich in der Suche anders verhält als erwartet.

Nein. Es ist eine fokussierte, kostenlose Prüfung für einen bestimmten Workflow. Bei großen Websites nutzen Sie es ergänzend zu einem Crawler und der Google Search Console, um Fehler zu priorisieren.

Möchten Sie das automatisiert für Ihre gesamte Website?

SERPView überwacht Title-Tags, Meta-Beschreibungen und strukturierte Daten für jede URL — und benachrichtigt Sie, sobald etwas kaputtgeht oder sich verbessern lässt.

Kostenlos starten