SEO

KI-Crawler und robots.txt: GPTBot, ClaudeBot, PerplexityBot & Co. richtig steuern

von Benjamin Kaim
SEO & KI Experte
Aktualisiert: 3 Min. Lesezeit

Die großen KI-Anbieter nutzen getrennte Crawler für ihre Suche und für das Training ihrer Modelle. Wer in ChatGPT, Claude oder Perplexity als Quelle erscheinen will, muss vor allem die Such-Crawler zulassen: OAI-SearchBot, Claude-SearchBot und PerplexityBot. Trainings-Crawler wie GPTBot, ClaudeBot oder Google-Extended können Sie sperren, ohne die Suche zu beeinträchtigen.

  • Such-Crawler zulassen, sonst erscheinen Sie nicht als Quelle.
  • Trainings-Crawler sind eine Grundsatzentscheidung, keine Voraussetzung für Sichtbarkeit.
  • Google-Extended beeinflusst die Google-Suche und AI Overviews nicht.
  • Nutzergesteuerte Abrufe wie Perplexity-User beachten robots.txt nicht immer.

Such-Crawler, Trainings-Crawler, Nutzer-Abrufe

KI-Anbieter unterscheiden drei Arten von Zugriffen. Für Ihre robots.txt ist diese Unterscheidung entscheidend:

  • Such-Crawler erfassen Seiten, damit sie in der KI-Suche als Quelle erscheinen können.
  • Trainings-Crawler sammeln Inhalte für das Training künftiger Modelle.
  • Nutzer-Abrufe entstehen, wenn ein Nutzer die KI bittet, eine Seite zu öffnen oder eine Frage live zu recherchieren.

Die wichtigsten KI-Crawler im Überblick

KI-Crawler der großen Anbieter
User-AgentAnbieterZweckEmpfehlung für Sichtbarkeit
OAI-SearchBotOpenAIChatGPT-Suchezulassen
GPTBotOpenAITrainingoptional
ChatGPT-UserOpenAINutzer-Abrufezulassen
Claude-SearchBotAnthropicSuche in Claudezulassen
ClaudeBotAnthropicTrainingoptional
Claude-UserAnthropicNutzer-Abrufezulassen
PerplexityBotPerplexityPerplexity-Suchezulassen
Perplexity-UserPerplexityNutzer-Abrufebeachtet robots.txt laut Perplexity meist nicht
GooglebotGoogleGoogle-Suche, AI Overviews, KI-Moduszulassen
Google-ExtendedGoogleNutzung für Gemini-Modelleoptional, ohne Einfluss auf die Suche

Was die Anbieter selbst sagen

  • OpenAI: Websites, die in der ChatGPT-Suche erscheinen wollen, sollen OAI-SearchBot nicht blockieren. GPTBot dient dem Training und kann ausgeschlossen werden.
  • Anthropic: Wer Claude-SearchBot blockiert, wird nicht für die Suche erfasst, was die Sichtbarkeit verringert. Eine Sperre von ClaudeBot schließt künftige Inhalte vom Training aus.
  • Perplexity: Wird PerplexityBot blockiert, erscheint die Website nicht in den Perplexity-Ergebnissen. Perplexity empfiehlt, ihn zuzulassen.

„Google-Extended does not impact a site’s inclusion in Google Search nor is it used as a ranking signal in Google Search.“

Google Search Central, Dokumentation der Google-Crawler

robots.txt-Vorlage für KI-Sichtbarkeit

Diese Vorlage lässt alle Such-Crawler zu. Die Trainings-Crawler sind auskommentiert, damit Sie bewusst entscheiden, ob Sie sie sperren möchten:

# KI-Suche: zulassen
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: PerplexityBot
Allow: /

# KI-Training: Entscheidung treffen, bei Bedarf Kommentarzeichen entfernen
# User-agent: GPTBot
# User-agent: ClaudeBot
# User-agent: Google-Extended
# Disallow: /

Sitemap: https://ihre-domain.de/sitemap_index.xml

Prüfen Sie außerdem Firewall, CDN und Bot-Schutz. Manche Dienste blockieren KI-Crawler standardmäßig, unabhängig von der robots.txt.

Weitere technische Voraussetzungen

  • Inhalte im HTML: Viele Crawler führen kein JavaScript aus. Texte, Preise und FAQ sollten serverseitig ausgeliefert werden.
  • Indexierung: Für AI Overviews und den KI-Modus muss eine Seite laut Google indexiert und snippet-fähig sein.
  • Strukturierte Daten: Schema für Organisation, Artikel, Autor, FAQ und Leistungen macht Inhalte eindeutig.
  • Ladezeit: Schnelle Seiten werden zuverlässiger gecrawlt.
  • llms.txt: Eine Übersicht für Sprachmodelle. Sie ist ein Vorschlag und kein Standard, aber schnell eingerichtet. Mehr im Lexikon unter llms.txt.

Für große Websites lohnt zusätzlich ein Blick auf das Crawl-Budget.

Weitere typische Stolperfallen erklärt der Artikel Häufige GEO-Fehler.

Welche drei Crawler Anthropic betreibt und welche Sie zulassen sollten, erklärt Claude SEO.

Häufige Fragen

Verliere ich Sichtbarkeit, wenn ich GPTBot sperre?

Nicht in der ChatGPT-Suche, denn dafür ist OAI-SearchBot zuständig. Ihre Inhalte fließen dann aber nicht in das Training künftiger Modelle ein, was langfristig das Trainingswissen über Ihre Marke beeinflussen kann.

Wie prüfe ich, ob KI-Crawler meine Seite besuchen?

In den Server-Logfiles nach den User-Agents filtern, zum Beispiel OAI-SearchBot oder PerplexityBot. Manche Hosting- und CDN-Anbieter zeigen Bot-Zugriffe auch in ihrer Oberfläche an.

Reicht eine offene robots.txt für KI-Sichtbarkeit?

Nein, sie ist nur die Voraussetzung. Ob KIs Ihre Marke nennen, hängt von Inhalten, Erwähnungen und Platzierungen ab. Einen Überblick gibt der Leitfaden KI-Sichtbarkeit.