Googlebot-Verifizierer

Crawler lists updated 22 days ago.

Pick the bot the user-agent string claims — spoof detection only runs when there's a claim to test. Try it with a real one: — fills the form; press Verify to run the check (checks are rate-limited).

Die Prüfungen laufen auf unserem Server. Wir rufen die von dir eingegebene URL ab und speichern die Ergebnisse nicht. Submitted IPs are checked in memory, never stored. Anonymous aggregate verdict counts feed our research posts; domains are counted once via an anonymized hash, never stored in the clear. Anonyme Ergebniszähler auf Ausführungsebene können für aggregierte Forschung verwendet werden; URLs, Domains, IP-Adressen und Kennungen werden nie einbezogen, und Statistiken werden erst ab 100 Ausführungen veröffentlicht.

Rückmeldung
Fehler melden

Funktioniert etwas in Googlebot-Verifizierer nicht? Teile uns mit, was passiert ist — die Meldung geht direkt an eine private Prüfwarteschlange, nicht in eine öffentliche Liste.

Gesendete Angaben
 Werkzeugeingaben, Uploads, eingefügte Quellen, vollständige Ergebnisse, Abfrageparameter und URL-Fragmente werden nicht automatisch angehängt. Du kannst die oben ausgewählte Passage bearbeiten oder entfernen. Browser- und Missbrauchsschutz-Metadaten werden zur Spamabwehr verarbeitet. 

Bulk IPs or access-log lines

Paste up to 500 IPs or log lines. Published-range matching and user-agent claim extraction run entirely in your browser. Use Spot-check only for the few rows where you want live reverse-DNS confirmation.

Supported bots and verification methods

Not every operator makes verification possible. Some publish IP ranges and support reverse DNS, some publish ranges only, and some publish nothing at all — a user agent alone proves nothing, since any script can send any user-agent string.

BotOperatorTypePublished IP listReverse DNS
Googlebot · docs Google Search ✅ 315 ranges ✅ .googlebot.com, .google.com
Google special crawlers · docs Google Search ✅ 270 ranges ✅ .google.com
Google user-triggered fetchers · docs Google User-triggered ✅ 1550 ranges ✅ .gae.googleusercontent.com, .google.com, .googleusercontent.com
Bingbot · docs Microsoft Search ✅ 28 ranges ✅ .search.msn.com
YandexBot · docs Yandex Search ❌ none ✅ .yandex.ru, .yandex.net, .yandex.com
Baiduspider · docs Baidu Search ❌ none
Yeti · docs Naver Search ❌ none
GPTBot · docs OpenAI AI training ✅ 21 ranges
OAI-SearchBot · docs OpenAI AI search ✅ 35 ranges
ChatGPT-User · docs OpenAI User-triggered ✅ 258 ranges
ClaudeBot · docs Anthropic AI training ✅ 20 ranges
PerplexityBot · docs Perplexity AI search ✅ 8 ranges
Perplexity-User · docs Perplexity User-triggered ✅ 4 ranges
Applebot · docs Apple Search ✅ 12 ranges ✅ .applebot.apple.com
Amazonbot · docs Amazon AI training ❌ none ✅ .crawl.amazonbot.amazon
DuckDuckBot · docs DuckDuckGo Search ✅ 481 ranges
Meta-ExternalAgent · docs Meta AI training ❌ none
Bytespider ByteDance AI training ❌ none

How verification works

  1. Published-range check. The IP is matched against the operator's official IP range list (the same JSON files Google, Microsoft, OpenAI, Perplexity, Apple, and DuckDuckGo publish), refreshed weekly.
  2. Forward-confirmed reverse DNS (FCrDNS). For bots that support it, the IP's PTR record must resolve to an official hostname (e.g. crawl-66-249-66-1.googlebot.com) at a domain-label boundary, and a forward lookup of that hostname must answer the exact same IP. Both directions must agree — a PTR record alone is trivially fakeable.
  3. Naming the spoofer. When a claim fails both checks, the IP's actual network owner is looked up via its ASN, so the verdict says who it really is instead of just "not Googlebot."

The verdict tiers are deliberately distinct: reverse-DNS confirmed is proof; a published-list match is strong but not confirmation; and unverifiable bots such as Bytespider and Meta publish no machine-readable range list — treat those user agents with suspicion. ClaudeBot now has an official published list, so it can return a list match even though Anthropic does not document reverse-DNS verification.

Need evidence across many requests? Use the Log File Analyzer to inspect crawl budget by bot and section, status-code waste, and spoofing signals. Log parsing stays in your browser.

Über dieses Werkzeug

Prüfe eine behauptete Crawler-IP gegen veröffentlichte Operator-Bereiche und vorwärts bestätigtes Reverse-DNS (FCrDNS). Der Verifizierer nennt bei Spoofing den tatsächlichen Netzwerkbesitzer und liefert kopierbare Regeln für die markierte IP.

IP-Adressen werden nur im Speicher geprüft und niemals gespeichert; ein User-Agent allein beweist keine Identität.

Funktionen

  • Zwei unabhängige Prüfungen: veröffentlichte IP-Bereiche und vorwärts bestätigtes Reverse-DNS
  • Fünf Verdicts einschließlich ehrlich „Nicht verifizierbar“
  • Unterstützung für IPv4/IPv6 und bis zu 500 IPs oder Logzeilen im Bulk-Modus
  • Copy-Paste-Blockregeln für Cloudflare WAF, nginx und Apache bei Spoofing

So funktioniert es

Nimm die IP aus Serverlogs, nicht nur den User-Agent. Vergleiche sie mit dem veröffentlichten Bereich, löse den PTR-Namen rückwärts auf und führe eine Vorwärtsauflösung desselben Hostnamens durch. Beide Richtungen müssen an einer offiziellen Domain-Grenze zur exakten IP passen.

Einschränkungen

  • Die Verifizierung ist nur so gut wie die Veröffentlichungen des Operators. Manche Crawler publizieren keine Bereiche oder unterstützen kein Reverse-DNS und bleiben nicht verifizierbar.
  • Ein grünes Verified-Badge bestätigt die Identität, nicht die Absicht; auch ein echter Crawler kann rate-limitiert oder blockiert werden.
  • Bereichslisten werden wöchentlich aus offiziellen Quellen erneuert; ein Urteil spiegelt einen Snapshot wider, der wenige Tage alt sein kann.

Häufig gestellte Fragen

Wie verifiziere ich, dass Googlebot echt ist?

Prüfe die IP gegen Googles veröffentlichte Bereiche und führe FCrDNS aus. Der `PTR`-`Hostname` muss auf googlebot.com oder google.com enden und die Vorwärtsauflösung muss dieselbe IP liefern.

Was ist vorwärts bestätigtes `Reverse`-`DNS` (`FCrDNS`)?

Eine Rückwärtsauflösung führt per `PTR` von der IP zu einem Hostnamen; eine Vorwärtsauflösung muss von diesem Hostnamen zurück zur exakten IP führen. Ein `PTR` allein beweist nichts.

Warum ist ein Crawler nicht verifizierbar?

Der behauptete Operator publiziert möglicherweise weder maschinenlesbare IP-Bereiche noch `Reverse`-`DNS`. Der Prüfer meldet dann „Nicht verifizierbar“, statt zu raten.

Kann ich einen falschen Crawler per IP blockieren?

Ja, der Prüfer erzeugt bei einem Spoofing-`Verdict` Regeln für `Cloudflare`, `nginx` und `Apache`. Für dauerhaften `Fake`-Crawler-`Traffic` ist eine `ASN`- oder Firewall-Regel wirksamer, weil einzelne IPs rotieren.

Werden geprüfte IP-Adressen gespeichert?

Nein. IP-Adressen werden im Arbeitsspeicher mit veröffentlichten Bereichslisten und aktivem `DNS` geprüft und nicht gespeichert. Die Listen werden wöchentlich aus offiziellen Betreiberquellen aktualisiert.

Nächster SchrittXML-Sitemap-Generator — generate the corrected version. Anleitung auf Englisch verfügbar.