Crawler-Zugriff ist keine Sichtbarkeit
GPTBot war da, PerplexityBot auch. Das liest sich im Serverprotokoll wie ein Erfolg und ist keiner. Zwischen dem Abruf einer Seite und einer KI-Antwort, die Ihr Unternehmen nennt, liegen zwei weitere Ereignisse, die jedes für sich ausbleiben können. Dieser Text nimmt die drei auseinander.
Stand: 8. September 2026
Der Beitrag Was bringt GEO wirklich? nennt die drei Begriffe kurz: Crawler-Zugriff, Erwähnung, Zitat. Hier geht es darum, was jedes einzelne bedeutet, woran man es erkennt und warum die üblichen Berichte sie in eine Zahl werfen. Das ist keine akademische Unterscheidung. Wer die drei verwechselt, misst am Ende etwas, das steigen kann, während die tatsächliche Sichtbarkeit fällt.
Was bedeutet ein Crawler-Zugriff?
Ein Crawler ist ein Programm, das Webseiten abruft, um sie zu speichern oder auszuwerten. OpenAI, Anthropic, Perplexity und Google betreiben jeweils eigene; sie melden sich im Serverprotokoll mit Namen wie GPTBot, ClaudeBot oder PerplexityBot. Taucht einer davon auf, ist genau eines belegt: Die Seite war erreichbar, die robots.txt hat sie nicht gesperrt, der Anbieter hat sie geholt.
Nicht belegt ist alles Weitere. Ob der Inhalt in ein Modell eingeflossen ist. Ob er in einem Index liegt, aus dem Antworten gespeist werden. Ob er je als passend für eine Frage bewertet wurde. Ein Praktiker fasste das in einem Fachforum so zusammen: Einen Bot auf der Seite zu sehen, ist eine nützliche Information; es sagt aber nicht, dass die Seite zitiert, empfohlen oder auch nur in einer Antwort verwendet wurde.
Wie wenig der Zugriff bedeutet, zeigt ein Versuch aus dem Jahr 2026: Eine frei erfundene Datei über Bürokatzen wurde von KI-Bots abgerufen und von Google indexiert, ohne dass sie irgendeinen Wert gehabt hätte. Der Crawler unterscheidet nicht zwischen brauchbar und Unsinn. Er holt, was erreichbar ist.
Trotzdem ist der Zugriff nicht bedeutungslos: Er ist Voraussetzung. Nach einer Auswertung von Ahrefs sperren 5,9 Prozent von 140 Millionen untersuchten Websites den GPTBot aus, teils bewusst, teils aus Versehen durch eine alte Regel in der robots.txt. Wer gesperrt ist, kommt in den nächsten beiden Stufen nicht an. Crawler-Zugriff ist also eine Prüfung, die man bestehen muss, keine Kennzahl, die man steigern sollte. Mehr Bot-Verkehr ist nicht mehr Sichtbarkeit; er kostet Serverleistung und sagt nichts.
Was bedeutet eine Erwähnung?
Eine Erwähnung liegt vor, wenn der Name Ihres Unternehmens in einer Antwort vorkommt. Jemand fragt ChatGPT nach Anbietern für eine Leistung in einer Region, und Ihr Name steht in der Liste. Das ist Sichtbarkeit im engeren Sinn, und es ist das, was die meisten meinen, wenn sie fragen, ob sie „in der KI vorkommen".
Eine Erwähnung heißt aber nicht, dass Ihre Website die Quelle war. Sprachmodelle kennen Firmennamen aus Branchenverzeichnissen, Presseartikeln, Bewertungsportalen und Foren. Perplexity greift nach Beobachtungen aus der Fachcommunity stark auf Foren und Reddit zurück; Gemini und ChatGPT zitieren Reddit ebenfalls häufig. Eine Erwähnung kann also vollständig aus fremden Seiten stammen, und sie bringt deren Fehler mit: eine veraltete Adresse, eine Leistung, die Sie nicht mehr anbieten, eine Einschätzung, die jemand vor drei Jahren in einem Forum hinterlassen hat.
Deshalb wirft jede Erwähnung zwei Fragen auf. Stimmt, was da steht? Und woher hat das Modell es? Solange die zweite Frage offen ist, lässt sich an der Erwähnung nichts steuern. Man weiß, dass man vorkommt, aber nicht, warum.
Was bedeutet ein Zitat?
Ein Zitat liegt vor, wenn die Antwort Ihre Seite als Quelle ausweist: als Link, als Fußnote, in einem Quellenkasten. Hier stützt sich die Antwort erkennbar auf Ihren Inhalt. Das ist das einzige der drei Ereignisse, das sich mit dem verbinden lässt, was Sie selbst kontrollieren, nämlich mit dem Text auf Ihrer eigenen Website. Und es ist das Ereignis, auf das Maßnahmen an der Website überhaupt wirken können.
Wie eng das Zitat am klassischen Suchmaschinenranking hängt, zeigt eine Auswertung von Ahrefs: 76 Prozent der Zitate in Google AI Overviews stammen aus Seiten, die ohnehin in den organischen Top 10 stehen. Wer dort nicht auftaucht, wird selten zitiert, unabhängig davon, wie oft ein Crawler vorbeikommt.
Zwei Einschränkungen gehören dazu. Ein Zitat ist kein Besuch: Die Quelle kann ausgewiesen sein, ohne dass jemand klickt. Und ein Zitat ist keine Empfehlung: Eine Seite kann als Beleg für eine Definition oder einen Sachverhalt zitiert werden, ohne dass das Unternehmen dahinter überhaupt genannt wird.
Warum aus dem einen nicht das andere folgt
Die drei Ereignisse bilden eine Reihenfolge, aber keine Kette. In eine Richtung gilt die Abhängigkeit: Ohne Zugriff kein Zitat von der eigenen Seite. In die andere Richtung gilt nichts.
- Zugriff ohne Erwähnung ist der Normalfall. Die meisten abgerufenen Seiten tauchen in keiner Antwort auf.
- Erwähnung ohne Zitat ist häufig. Das Modell kennt den Namen aus einer fremden Quelle und nennt ihn, ohne Ihre Seite je herangezogen zu haben.
- Zitat ohne Erwähnung ist möglich. Ihre Seite belegt einen Sachverhalt, Ihr Unternehmen kommt in der Antwort nicht vor.
Wer die drei in einer Kennzahl zusammenzählt, erhält eine Zahl ohne Aussage. Sie kann steigen, weil ein Crawler häufiger vorbeikommt, während die Zitate zurückgehen. Sie kann fallen, weil eine Sperre greift, während die Erwähnungen aus fremden Quellen unverändert bleiben.
Was zeigt der Search-Console-Bericht und was nicht?
Google hat in der Search Console einen Bericht zur generativen Sichtbarkeit eingeführt. In einem Fachforum kursierte ein Beispiel mit 35.900 Impressionen, das prompt die Frage auslöste, was diese Zahl eigentlich zählt.
Was der Bericht zeigt: Erscheinungen in KI-Oberflächen von Google, aufgeschlüsselt nach Seite, Land, Datum und Gerät. Was er nicht zeigt: die Suchanfrage. Und er trennt nicht zwischen dem Erscheinen in einer KI-Oberfläche und dem Zitiertwerden als die Quelle, auf die sich die Antwort tatsächlich stützt. Genau diese Unterscheidung hat ein Nutzer in der Diskussion angemahnt: Das Auftauchen in einer KI-Antwort und das Quelle-Sein sind verschiedene Ereignisse, und der Impressionswert fasst sie zusammen.
Für Google-Oberflächen sagt der Bericht also: Etwas von Ihnen ist irgendwo vorgekommen, ohne dass sich nachvollziehen lässt, bei welcher Frage. Für ChatGPT, Perplexity und Claude gibt es nicht einmal das.
Wie sich die drei Ereignisse getrennt messen lassen
Crawler-Zugriff steht in den Serverprotokollen; man filtert nach dem Namen des Bots. Dazu gehört ein Blick in die robots.txt, ob einer der Crawler gesperrt ist. Das prüft man einmal und danach bei jeder Änderung an der Seite, nicht fortlaufend.
Erwähnung und Zitat liefert kein Anbieter als Statistik. Man muss fragen. Praktisch heißt das: eine feste Liste von Fragen, formuliert wie ein Kunde sie stellen würde, an mehrere Systeme gerichtet, Antworten protokolliert. Für jede Antwort werden zwei Dinge festgehalten: Kommt der Name vor? Wird die eigene Seite als Quelle ausgewiesen? Dazu, welche anderen Seiten zitiert werden, denn das sind die Quellen, aus denen Erwähnungen stammen können.
Der Haken ist die Schwankung. Dieselbe Frage kann heute mit Ihnen und morgen ohne Sie beantwortet werden; in Fachforen wird die Sichtbarkeit in KI-Antworten als deutlich zufälliger beschrieben als die klassische Suche, und es wird offen gefragt, ob Sichtbarkeitswerte überhaupt etwas bedeuten, wenn sich die Fragen zwischen zwei Messungen ändern. Die Antwort darauf ist methodisch, nicht technisch: dieselben Fragen, wörtlich gleich, mehrfach gestellt, mit Datum. Erst eine Reihe zeigt, ob ein Unterschied ein Unterschied ist oder eine Schwankung.
Werkzeuge, die das automatisieren, gibt es zwischen 29 und 399 US-Dollar im Monat, mit Grenzen bei der Zahl der Fragen und der abgedeckten Systeme. Wer eines kauft, sollte vorher wissen, welches der drei Ereignisse es zählt. Ein Werkzeug, das Bot-Verkehr als Sichtbarkeit ausweist, misst die falsche Stufe.
Was daraus für Ihre Website folgt
- Zugriff sicherstellen, dann nicht mehr hinsehen. Sperre prüfen, Erreichbarkeit prüfen, fertig. Bot-Verkehr als Kennzahl in einem Bericht ist ein Warnsignal für den Bericht, nicht für die Seite.
- Erwähnungen auf Richtigkeit prüfen. Für das, was ein Modell über Sie sagt, gibt es keinen Korrekturknopf. Wer weiß, aus welcher fremden Seite eine falsche Angabe stammt, kann dort ansetzen; wer es nicht weiß, kann nur die eigene Seite so eindeutig machen, dass sie als Quelle vorgezogen wird.
- Zitate als Ziel setzen. Sie hängen an Dingen, die sich beeinflussen lassen: an der Position in der klassischen Suche, an der Aktualität und daran, ob eine Seite eine konkrete Frage vollständig beantwortet.
- Die Größenordnung im Blick behalten. Nach einer Auswertung von Surfer schickt Google weiterhin 190-mal mehr Besucher auf Websites als ChatGPT. Ein Zitat in einer KI-Antwort ist ein Kanal, nicht der Kanal.
Ob Ihr Unternehmen in ChatGPT, Perplexity und Gemini genannt wird, und mit welcher Beschreibung, zeigt der kostenlose KI-Sichtbarkeitscheck.
Fragen wir gemeinsam die KI nach Ihnen.
Der Sichtbarkeitscheck kostet nichts: Sie nennen uns Firma, Leistung und Region, wir schicken das Ergebnis in der Regel innerhalb eines Werktags.