Prüfer für KI-Crawler-Zugriff

Free, no signup. “Am I letting ChatGPT, Claude, Perplexity, and Google’s AI read this page — and did I mean to?” Enter a URL and get the answer for every major AI crawler, with the exact robots.txt rule that decided it.

Five separate tests · registry 2026-07-29

Crawler access is only the first layer

Permission

Is the crawler allowed?

Extractability

Are useful facts present in raw HTML?

Renderability

Does JavaScript successfully expose them?

Operability

Can an agent identify and use semantic controls?

Commerce readiness

Do page, schema, feed and checkout facts agree?

HTML remains primary. llms.txt, UCP, and other protocol files are optional distribution layers and cannot compensate for inaccessible or unextractable HTML.

Validate a protocol response

Upload verified-bot log evidence

Expected columns: crawler, timestamp, url, status, verification. A user-agent string alone is never treated as verified identity.

No log evidence uploaded.

robots.txt is advisory, not a lock. It tells cooperating crawlers what you prefer — it does not enforce anything. Some crawlers below are reported to ignore it (flagged ⚠). To actually stop a crawler, block it at your CDN/WAF and verify it's genuine by IP.

Die Prüfungen laufen auf unserem Server. Wir rufen die von dir eingegebene URL ab und speichern die Ergebnisse nicht. Anonyme Ergebniszähler auf Ausführungsebene können für aggregierte Forschung verwendet werden; URLs, Domains, IP-Adressen und Kennungen werden nie einbezogen, und Statistiken werden erst ab 100 Ausführungen veröffentlicht.

Rückmeldung
Fehler melden

Funktioniert etwas in Prüfer für KI-Crawler-Zugriff nicht? Teile uns mit, was passiert ist — die Meldung geht direkt an eine private Prüfwarteschlange, nicht in eine öffentliche Liste.

Gesendete Angaben
 Werkzeugeingaben, Uploads, eingefügte Quellen, vollständige Ergebnisse, Abfrageparameter und URL-Fragmente werden nicht automatisch angehängt. Du kannst die oben ausgewählte Passage bearbeiten oder entfernen. Browser- und Missbrauchsschutz-Metadaten werden zur Spamabwehr verarbeitet. 
Set your posture → robots.txt block

Pick what to block; copy the generated rules into your robots.txt.

  

Blocking here means “documented posture,” not enforcement — a cooperating crawler will honor it; a hostile one may not.

Crawler roster last reviewed . Data is hand-maintained and editable (src/data/ai-crawlers.json).

Über dieses Werkzeug

Prüfe, ob GPTBot, ClaudeBot, PerplexityBot, Google-Extended und weitere KI-Crawler deine robots.txt-Regeln für eine öffentliche URL erlauben oder blockieren. Der Matcher verwendet Googles Open-Source-Parser und zeigt die gewinnende Regel sowie eine llms.txt-Prüfung.

robots.txt ist eine Empfehlung, keine Sperre; Allowed/Blocked beschreibt dokumentierte Haltung, nicht tatsächliche Durchsetzung.

Funktionen

  • Allowed/Blocked je KI-Crawler mit gewinnender robots.txt-Regel und Zeilennummer
  • Gruppierung nach Live retrieval & answer citation und Model training
  • Verifizierbar/Unverifizierbar über veröffentlichte IP-Bereiche oder FCrDNS und Bot-Verifier-Querverweis
  • Posture-Generator für Training/Retrieval-Pfade mit kopierbaren robots.txt-Regeln ohne Googlebot-Verbot

So funktioniert es

Gib eine URL ein und löse Turnstile. Der Server holt robots.txt sowie llms.txt, der Browser wendet den Parser auf jeden Crawler an und zeigt Regel/Zeile. Wähle im Generator Training/Retrieval und Pfad; exportiere die Regeln, blockiere nicht pauschal Googlebot.

Einschränkungen

  • Crawler können robots.txt ignorieren; echte Sperre erfordert CDN/WAF und IP-Prüfung.
  • Ein User-Agent ist spoofbar; unverifizierbar bedeutet fehlende veröffentlichte Prüfmethode, nicht echt oder falsch.
  • llms.txt ändert kein Verdict; kein großer KI-Crawler ist dokumentiert als Leser.

Häufig gestellte Fragen

Verhindert das Blockieren von `GPTBot`, dass `ChatGPT` meine Website zitiert?

Nicht zwingend. Trainings-, Such- und Nutzerabrufe können unterschiedliche Systeme und Regeln verwenden. Eine robots.txt-Regel kontrolliert nur Crawler, die sie beachten.

Kann ich Google AI Overviews mit robots.txt ablehnen?

Nicht separat über eine spezielle Overview-Regel. Googles dokumentierte Such-Crawler-Regeln und Vorschaukontrollen gelten; eine Blockierung von Googlebot kann auch die normale Suche beeinträchtigen.

Kann robots.txt einen KI-Crawler sicher stoppen?

Nein. robots.txt ist eine freiwillige Richtlinie. Für eine technische Sperre brauchst du `CDN`- oder `WAF`-Regeln sowie eine Prüfung der tatsächlichen Client-IP; `User-Agent`-Zeichenfolgen allein lassen sich fälschen.

Was bedeutet unverifizierbar?

Für den behaupteten Crawler fehlt eine veröffentlichte IP- oder `FCrDNS`-Prüfmethode. Das ist kein Beweis für echt oder falsch, sondern eine getrennte Evidenzstufe.

Ändert eine `llms.txt`-Datei eines dieser Urteile?

Nein. `llms.txt` ist eine vorgeschlagene Inhaltskonvention und keine Zugriffskontrolle. Die Urteile beruhen auf `robots.txt` und verifizierbaren Crawler-Signalen.

Nächster Schrittrobots.txt-Generator — generate the corrected version. Anleitung auf Englisch verfügbar.