Auf einen Blick
- Zuerst der Zugang: Sperren in der robots.txt oder beim CDN halten KI-Crawler fern, oft ohne dass es jemand bemerkt.
- Ohne Eintrag im Google- und im Bing-Index fehlt die Grundlage für Antworten mit Quellenangabe.
- Feste Fragen, regelmäßig in mehreren Assistenten gestellt, ergeben eine vergleichbare Messreihe.
- Besuche aus KI-Antworten sind in der Webanalyse an Quellen wie chatgpt.com oder perplexity.ai erkennbar.
Test 1: Erreichen KI-Crawler die Website?
Jeder Anbieter schickt eigene Crawler. Einige sammeln Texte für das Training der Modelle, andere bauen den Index für die Websuche auf, wieder andere rufen eine Seite ab, wenn jemand im Chat danach fragt. Für Antworten mit Quellenangabe zählen vor allem die beiden letzten Gruppen.
- OAI-SearchBot
- OpenAI, Index der ChatGPT-Suche
- ChatGPT-User
- OpenAI, Abruf auf Anfrage im Chat
- GPTBot
- OpenAI, Training der Modelle
- PerplexityBot
- Perplexity, Suchindex
- Perplexity-User
- Perplexity, Abruf auf Anfrage
- Claude-SearchBot
- Anthropic, Suchindex
- Claude-User
- Anthropic, Abruf auf Anfrage
- ClaudeBot
- Anthropic, Training der Modelle
- Bingbot
- Microsoft, Bing-Index, auch Grundlage für Copilot
- Googlebot
- Google, Suchindex, auch Grundlage für AI Overviews
- Google-Extended
- Kein eigener Crawler: Kennung in der robots.txt, die die Nutzung durch Gemini steuert
Zu prüfen sind drei Stellen: die robots.txt der Website (unter /robots.txt), die Einstellungen von CDN oder Firewall (bei Cloudflare unter AI Crawl Control) und, falls zugänglich, die Server-Protokolle. Dort zeigt sich, ob die Crawler tatsächlich vorbeikommen und welche Antwort sie erhalten. Der Statuscode 403 bedeutet: abgewiesen.
Test 2: Ist die Website in den Suchindizes?
Eine Suche nach site:beispiel-gmbh.de bei Google und bei Bing zeigt grob, wie viele Seiten jeweils bekannt sind. Genauer sind die Search Console von Google und die Bing Webmaster Tools: Beide zeigen, welche Seiten indexiert sind, welche nicht und warum. Fehlen wichtige Leistungsseiten, liegt das Problem vor jeder KI-Optimierung.
Test 3: Nennen die Assistenten das Unternehmen?
Aussagekräftig wird der Test erst mit festen Fragen, die regelmäßig in gleicher Form gestellt werden. Drei Arten von Fragen decken das Wesentliche ab:
- Marke: „Was macht die Beispiel GmbH?“ zeigt, was ein Assistent über das Unternehmen weiß.
- Leistung und Region: „Wer wartet Kühlanlagen in Hamburg?“ zeigt, ob das Unternehmen bei konkretem Bedarf genannt wird.
- Problem: „Wie lässt sich der Stromverbrauch eines Kühlraums senken?“ zeigt, ob Fachinhalte als Quelle dienen.
Gestellt werden die Fragen in ChatGPT mit Websuche, in Perplexity, in Microsoft Copilot und in der Google-Suche mit AI Overviews und AI Mode, am besten ohne Anmeldung oder in einem neuen Chat, damit frühere Gespräche das Ergebnis nicht färben. Festgehalten wird je Frage: genannt oder nicht, an welcher Stelle, mit Link oder ohne und welche Quellen der Assistent angibt.
Antworten schwanken. Dieselbe Frage kann am nächsten Tag anders beantwortet werden. Aussagekräftig ist deshalb der Verlauf über Monate, nicht der einzelne Test.
Test 4: Stimmen die Fakten?
Assistenten geben mitunter veraltete Leistungen, falsche Adressen oder Angaben gleichnamiger Firmen wieder. Korrigieren lässt sich das nur an den Quellen: auf der eigenen Website, in den strukturierten Daten, im Google-Unternehmensprofil, in Branchenverzeichnissen und in Profilen. Je einheitlicher Name, Anschrift und Leistungen überall stehen, desto seltener verwechseln Assistenten ein Unternehmen.
Test 5: Kommen Besuche aus KI-Antworten an?
In der Webanalyse erscheinen Besuche aus KI-Antworten mit eigenen Quellen, etwa chatgpt.com, perplexity.ai, copilot.microsoft.com oder gemini.google.com. ChatGPT ergänzt Links meist um utm_source=chatgpt.com. In Google Analytics 4 fasst eine eigene Kanalgruppe diese Quellen zusammen und macht sie über Monate vergleichbar.
Klicks aus Google AI Overviews lassen sich nicht getrennt ausweisen: Die Search Console zählt sie zusammen mit der übrigen Websuche.
Rhythmus und Aufwand
Für den Einstieg genügt etwa eine Stunde: Zugang und Index prüfen, zehn bis zwanzig Fragen festlegen, die erste Messung festhalten. Danach reicht ein monatlicher Durchgang mit denselben Fragen, ergänzt nach jeder größeren Änderung an der Website. Spezialisierte Werkzeuge stellen solche Fragen automatisch und in großer Zahl; für den Trend genügt anfangs eine Tabelle.
Die Grundlagen dahinter erklärt der Artikel SEO und GEO.
Häufige Fragen
Warum nennt ChatGPT ein Unternehmen nicht, das bei Google gefunden wird?
Die ChatGPT-Suche nutzt eigene Crawler und andere Indizes als Google. Häufige Ursachen sind eine Sperre für OAI-SearchBot, eine lückenhafte Indexierung bei Bing oder Angaben, die sich auf der Website nicht eindeutig zuordnen lassen.
Sollten auch die Crawler für das Training zugelassen werden?
Für Antworten mit Quellenangabe zählen die Such-Crawler. Das Training wirkt langfristig: Was in die Trainingsdaten eingeht, kann ein Modell auch ohne Websuche wiedergeben. Ob das gewollt ist, ist eine Abwägung zwischen Reichweite und Kontrolle über die eigenen Inhalte.