Welcher Crawler besucht deine Website — und warum?

Google, Bing, ChatGPT und Claude verwenden unterschiedliche Bots für Suche, Training und einzelne Nutzeranfragen. Hier findest du die Namen, die richtige robots.txt-Regel und die Belege, die du für eine echte Prüfung brauchst.

Grafik eines Crawlers zwischen Webseiten, Serverantworten und dem öffentlichen Web
Ein Crawl verbindet eine Anfrage mit einer Serverantwort. Indexierung, Ranking und Zitation passieren erst später.

Beginne mit der Aufgabe, nicht mit dem Bot-Namen.

Ein Name wie „AI-Crawler“ ist zu ungenau. Entscheidend ist, welches System den Abruf ausgelöst hat.

Für klassische Suche

Googlebot und Bingbot

Sie entdecken Seiten für Suchindizes. Erreichbarkeit ist nötig, aber keine Garantie für Indexierung oder Ranking.

Für AI-Suche

OAI-SearchBot und Claude-SearchBot

Sie unterstützen die Suchfunktionen ihrer Betreiber. Google verwendet für seine Suchoberflächen weiterhin die Regeln der Google-Suche; Google-Extended ist dafür nicht zuständig.

Für mögliches Modelltraining

GPTBot und ClaudeBot

Diese Bots lassen sich getrennt von den Suchbots steuern. Eine Sperre für Training muss deshalb nicht automatisch die AI-Suche sperren.

Für eine Nutzeranfrage

ChatGPT-User und Claude-User

Sie können eine Seite abrufen, weil ein Mensch gerade danach fragt. So ein Abruf beweist keine automatische Aufnahme in einen Suchindex.

1. AbrufEin Client fordert eine URL an und erhält Status, Header und HTML.
2. VerarbeitungEin Such- oder AI-System kann den Inhalt speichern, rendern oder verwerfen.
3. AuswahlEine spätere Suche oder Antwort kann die Seite auswählen — muss es aber nicht.

Crawler und Steuerung im direkten Vergleich

Die Rollen stammen aus der aktuellen Dokumentation der Betreiber. Ein User-Agent ist kopierbarer Text und allein kein Identitätsnachweis.

Zuletzt gegen Primärquellen geprüft: 28. August 2026
Crawler oder TokenBetreiber und AufgabeSteuerungPrüfungPreset
GooglebotOffizielle QuelleGoogle · Suchindexrobots.txt-Token GooglebotGoogle-IP-Liste oder Reverse- und Forward-DNSRegel testen
BingbotOffizielle QuelleMicrosoft · Bing-Suchindexrobots.txt-Token BingbotVerify-Bingbot oder Reverse- und Forward-DNSRegel testen
OAI-SearchBotOffizielle QuelleOpenAI · ChatGPT-SucheGetrennt von GPTBot steuerbarUser-Agent plus veröffentlichte OpenAI-IP-BereicheRegel testen
GPTBotOffizielle QuelleOpenAI · mögliches ModelltrainingEigener robots.txt-TokenUser-Agent plus veröffentlichte OpenAI-IP-BereicheRegel testen
ChatGPT-UserOffizielle QuelleOpenAI · NutzerabrufKeine Steuerung der SuchaufnahmeUser-Agent plus veröffentlichte OpenAI-IP-BereicheRegel testen
Claude-SearchBotOffizielle QuelleAnthropic · Claude-SucheEigener robots.txt-TokenUser-Agent plus veröffentlichte Anthropic-IP-ListeRegel testen
ClaudeBotOffizielle QuelleAnthropic · mögliches ModelltrainingGetrennt vom Suchbot steuerbarUser-Agent plus veröffentlichte Anthropic-IP-ListeRegel testen
Claude-UserOffizielle QuelleAnthropic · NutzerabrufEigener robots.txt-TokenUser-Agent plus veröffentlichte Anthropic-IP-ListeRegel testen
Google-ExtendedOffizielle QuelleGoogle · Gemini-Training und bestimmte Grounding-NutzungenProdukt-Token; beeinflusst Google Search nichtKein eigener HTTP-User-AgentRegel testen

Wie sicher ist ein Bot-Nachweis?

Verwende nur so viel Beweisstärke, wie deine Entscheidung verlangt. Für eine Statistik reicht oft eine markierte Vermutung. Für eine Firewall-Freigabe nicht.

  1. Behauptet

    Der User-Agent enthält Googlebot, GPTBot oder ClaudeBot.

    Nützlich zum Filtern. Leicht zu fälschen.
  2. Beobachtet

    Server-Log, IP-Adresse, Zeitpunkt, URL und Statuscode passen zusammen.

    Belegt den Request — noch nicht den Betreiber.
  3. Unterstützt

    Die IP liegt in einem aktuell veröffentlichten Bereich des Betreibers.

    Stärkerer Hinweis. Listen können sich ändern.
  4. Verifiziert

    Die vom Betreiber beschriebene IP- oder Reverse-/Forward-DNS-Prüfung ist bestanden.

    Geeignet für wichtige Zugriffsentscheidungen.

Was dir ein Logeintrag wirklich sagt

Ein bestätigter Request mit Status 200 zeigt: Dieser Bot konnte diese URL zu diesem Zeitpunkt abrufen. Er zeigt nicht, ob JavaScript vollständig verarbeitet, die Seite indexiert oder später als Quelle zitiert wurde. Ein 403 oder 429 ist dagegen ein konkreter Hinweis auf Firewall-, Bot-Schutz- oder Lastprobleme.

  1. User-Agent als Kandidat markieren.
  2. IP und Zeitpunkt aus derselben Logzeile sichern.
  3. IP nach der Methode des Betreibers prüfen.
  4. Statuscode, URL und Antwortgröße auswerten.

Von der URL zum belastbaren Befund

Die Werkzeuge beantworten verschiedene Teile derselben Diagnose. Starte mit dem Material, das du bereits hast.

Crawler-Analyse-Tool

Prüft eine öffentliche URL, robots.txt, Indexierungsdirektiven und das erste HTML.

Tool öffnen

robots.txt-Tester

Zeigt, welche Regel für Googlebot, OAI-SearchBot, GPTBot oder Claude gewinnt.

Tool öffnen

Crawler-Log-Analyse

Findet Bot-Kandidaten, Statuscodes und häufige Pfade in Apache- oder Nginx-Logs.

Tool öffnen

Was eine Seite für Suche und AI technisch braucht

Das schafft technische Eignung. Indexierung, Ranking oder Zitation bleiben Entscheidungen des jeweiligen Systems.

Leitfaden zur AI-Suche lesen
  • Eine stabile öffentliche HTTPS-URL mit brauchbarer 200-Antwort.
  • Eine robots.txt-Regel, die genau den gewünschten Bot nicht blockiert.
  • Keine unbeabsichtigte Sperre durch CDN, Firewall oder Bot-Schutz.
  • Eine klare Kernantwort und wichtige Links im Server-HTML.
  • Konsistente interne Links, Canonicals und Sitemap-Einträge.
  • Eigene, überprüfbare Inhalte statt austauschbarer Zusammenfassungen.

Und was ist mit Screaming Frog, Sitebulb oder Site-Audit-Tools?

Diese Crawler lösen eine andere Aufgabe: Sie prüfen eine Website im Auftrag des Betreibers. Ein fairer Vergleich braucht dieselbe unveränderte Testwebsite, dieselben Einstellungen und mehrere Läufe. Die erste kontrollierte Header-Baseline mit Rohdaten ist veröffentlicht. Ergebnisse realer Anbieter bleiben offen, bis wiederholbare Testläufe vorliegen — deshalb gibt es noch keinen künstlichen Sieger.

Benchmark und Rohdaten ansehen

Zwei typische Widersprüche sauber auflösen

robots.txt, CDN-Antwort und JavaScript-Rendering sind verschiedene Belege. Die beiden Leitartikel zeigen, wie du sie getrennt festhältst, statt aus einem Browserbild eine Crawler-Aussage abzuleiten.

Primärquellen und Pflege

Crawler-Namen, IP-Bereiche und Produktrollen ändern sich. Diese Seite stützt sich deshalb auf die Dokumentation der Betreiber und nennt das Prüfdatum.

Zuletzt gegen Primärquellen geprüft: 28. August 2026
Google: Crawler und Google-Extended Google: Requests verifizieren Bing: Crawler Bingbot verifizieren OpenAI: Crawler Anthropic: Claude-Crawler