SEO

KI-Crawler in Logfiles erkennen: So sehen Sie, ob ChatGPT & Co. Ihre Seite besuchen

von Benjamin Kaim
SEO & KI Experte
Aktualisiert: 3 Min. Lesezeit

In den Server-Logfiles sehen Sie, welche KI-Crawler Ihre Website abrufen, welche Seiten sie besuchen und ob sie Fehler bekommen. Erkennbar sind sie am User-Agent, etwa GPTBot oder OAI-SearchBot von OpenAI, ClaudeBot von Anthropic und PerplexityBot. Weil sich User-Agents leicht fälschen lassen, sollten Sie die IP-Adressen mit den Listen der Anbieter abgleichen. Die Auswertung zeigt, ob Ihre wichtigen Seiten für KI-Systeme erreichbar sind.

  • KI-Crawler sind am User-Agent erkennbar.
  • OpenAI, Perplexity und andere veröffentlichen IP-Bereiche zur Prüfung.
  • Wichtige Kennzahlen: abgerufene Seiten, Statuscodes, Häufigkeit.
  • Nutzer-Abrufe wie ChatGPT-User zeigen, dass Ihre Seite in Antworten gelesen wird.

Die wichtigsten KI-Crawler

KI-Crawler und ihre Aufgaben laut Anbietern
User-AgentAnbieterAufgabe
GPTBotOpenAIInhalte für das Training von Modellen
OAI-SearchBotOpenAIWebsites für die Suche in ChatGPT
ChatGPT-UserOpenAIAbruf, wenn Nutzer ChatGPT eine Frage stellen
ClaudeBotAnthropicInhalte für das Training
Claude-SearchBotAnthropicVerbesserung der Suchergebnisse
Claude-UserAnthropicAbruf bei Nutzerfragen
PerplexityBotPerplexityWebsites in der Perplexity-Suche anzeigen und verlinken
Perplexity-UserPerplexityAbruf bei Nutzerfragen
Googlebot / Google-ExtendedGoogleCrawling; Google-Extended ist nur ein Steuerungs-Token ohne eigenen User-Agent

So werten Sie Logfiles aus

  1. Zugriffsprotokolle beim Hoster herunterladen, meist im Kundenbereich unter Statistiken oder Logs.
  2. Nach den User-Agents filtern, zum Beispiel mit einem Tabellenprogramm oder einem Log-Analyse-Tool.
  3. Abgerufene URLs und Statuscodes auswerten: Kommen die Crawler auf Ihre wichtigen Seiten und erhalten sie den Status 200?
  4. Häufigkeit über die Zeit betrachten: Steigen die Abrufe nach neuen Inhalten oder Erwähnungen?
  5. Auffälligkeiten prüfen: viele 404-Fehler, Blockaden (403) oder Weiterleitungsketten.
grep -E "GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-SearchBot|Claude-User|PerplexityBot|Perplexity-User" access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head -20

Der Befehl zählt, welche URLs die KI-Crawler am häufigsten abgerufen haben. Je nach Log-Format kann die Spalte mit der URL abweichen.

Echte Crawler von Fälschungen unterscheiden

Jeder kann sich als GPTBot ausgeben. Vergleichen Sie deshalb die IP-Adressen mit den offiziellen Listen der Anbieter. Perplexity veröffentlicht zum Beispiel eigene JSON-Dateien mit den IP-Bereichen von PerplexityBot und Perplexity-User und empfiehlt, stets die aktuelle Liste zu verwenden. Auch OpenAI stellt entsprechende Listen bereit.

Was die Daten Ihnen sagen

Befunde und was sie bedeuten
BefundBedeutung
Viele Abrufe von ChatGPT-User oder Perplexity-UserIhre Seiten werden in Antworten auf Nutzerfragen gelesen
Keine Abrufe von Such-Crawlernmögliche Sperre in robots.txt, Firewall oder Cloudflare
Viele 403-FehlerBot-Schutz blockiert Crawler, siehe Cloudflare und KI-Crawler
Viele 404-Fehlerveraltete Links oder falsche URLs; Weiterleitungen einrichten
Crawler rufen nur die Startseite abinterne Verlinkung und Sitemap prüfen

Tools wie Ahrefs werten Crawler-Besuche inzwischen ebenfalls aus, siehe KI-Sichtbarkeit Tools im Vergleich. Besuche echter Nutzer aus KI-Assistenten messen Sie dagegen in der Webanalyse, siehe KI-Traffic in GA4 messen.

Wie sichtbar ist Ihre Marke? Der kostenlose Check zeigt, ob KI-Systeme Sie nennen.

Kostenlosen Check starten

Steckbriefe der Crawler: GPTBot, ClaudeBot und PerplexityBot.

Häufige Fragen

Muss ich Logfiles aus Datenschutzgründen besonders behandeln?

Logfiles enthalten IP-Adressen und sind daher personenbezogene Daten. Werten Sie sie zweckgebunden aus und beachten Sie die in Ihrer Datenschutzerklärung genannten Speicherfristen.

Warum sehe ich keine KI-Crawler in meinen Logfiles?

Entweder wurden Ihre Seiten noch nicht entdeckt oder die Crawler werden blockiert. Prüfen Sie robots.txt, Firewall, Cloudflare und Sicherheits-Plugins.

Beachtet Perplexity-User die robots.txt?

Laut Perplexity ignoriert Perplexity-User die robots.txt in der Regel, weil der Abruf von einer Person angestoßen wird. PerplexityBot beachtet sie.