Das Wichtigste in Kürze

  • Was es misst: welche KI-Crawler welche deiner Seiten abrufen, wie oft, und wie viele davon gegen die veröffentlichten IP-Bereiche der Betreiber verifiziert sind.
  • Was es zusätzlich zählt: Besucher, die aus einer KI-Antwort auf deine Seite klicken — ohne Cookie, ohne gespeicherte IP-Adresse, auch bei aktivem Seiten-Cache.
  • Was es steuert: eine erzeugte llms.txt und die robots.txt-Regeln je Crawler, getrennt nach Zweck (Training, KI-Suche, Abruf auf Nutzeranfrage).
  • Wo die Daten liegen: ausschließlich in der Datenbank deiner WordPress-Installation. Kein Konto, kein Cloud-Dienst, keine Telemetrie.
  • Was es kostet: nichts. GPL v2, keine Pro-Version mit abgeschnittenen Funktionen.
  • Stand August 2026: 42 Crawler-Signaturen, davon 40 mit eigener Kennung, plus 1.865 IP-Präfixe von fünf Betreibern. Version 1.4.7, geprüft mit WordPress 7.0 und PHP 8.5.

Eigenschaften der verschiedenen Crawler

Eine Liste von Crawler-Namen hilft niemandem. Deshalb bekommt jeder Crawler eine eigene Kurve und ein paar Sätze dazu, was ihn von den anderen unterscheidet — welche Entscheidung also dranhängt, wenn du ihn blockierst.

Aufgeklappte Einträge für GPTBot und OAI-SearchBot mit je einer Zugriffskurve über 30 Tage und einem erklärenden Absatz
Die Crawler-Seite: je Crawler ein aufklappbares Diagramm, darunter eine kurze Einordnung und der Anteil verifizierter Zugriffe.

Der Unterschied ist keine Feinheit. GPTBot sammelt Text fürs Modelltraining — ihn zu blockieren hält deine Texte aus künftigen GPT-Versionen heraus. Ob ChatGPT dich zitieren kann, ändert das nicht: dafür sind OAI-SearchBot und ChatGPT-User zuständig. Wer alle drei über einen Kamm schert, verschwindet aus den Antworten, ohne es zu wollen. Ausführlich steht das im Artikel KI-Crawler erlauben oder blockieren.

Welche Kennungen es gibt und was sie tun, dokumentieren die Betreiber selbst — OpenAI, Anthropic und Google führen öffentliche Listen. Das Plugin hält seine Signaturen über ein signiertes wöchentliches Update aktuell.

Sehen, welche Seiten gecrawlt werden

Interessanter als die Gesamtzahl ist meist, was gelesen wird: ob die Crawler auf deinen Ratgebertexten sitzen oder auf der Kontaktseite. Die Inhaltsansicht zeigt jede Adresse mit Zugriffen, verifizierten Treffern und gefälschten Kennungen, filterbar nach Crawler und Zweck, exportierbar als CSV.

Tabelle mit vier Seitenpfaden, Spalten für Zugriffe, Verifiziert und Gefälscht, darunter der Knopf für den CSV-Export
Die Inhaltsansicht mit Pfaden, Zugriffen, verifizierten und gefälschten Treffern.

Besucher aus KI-Antworten

Crawler-Zugriffe sind die eine Hälfte. Die andere sind Menschen, die in ChatGPT, Perplexity, Gemini oder Copilot eine Antwort lesen und dann auf deine Seite klicken. Ein kleines Skript meldet dabei nur den verweisenden Dienst und die Zielseite — kein Cookie, kein lokaler Speicher, keine IP-Adresse, kein Fingerabdruck.

Kurve der Besuche über 30 Tage, darunter Balken für ChatGPT, Perplexity, Google AI Studio und Microsoft Copilot
Besucher aus KI-Antworten: Verlauf, Quellen und Einstiegsseiten.

Weil die Zählung im Browser passiert, funktioniert sie auch dann, wenn ein Full-Page-Cache die Seite ausliefert. Wie du in diesen Antworten überhaupt auftauchst, behandeln wir getrennt für ChatGPT und Perplexity.

llms.txt und robots.txt für Wordpress automatisch generieren

Die robots.txt-Seite gruppiert alle bekannten Crawler nach Zweck und bietet vier Voreinstellungen an — von „keine Änderungen" bis „alle blockieren". Ausnahmen je Crawler haben Vorrang. Liegt eine echte robots.txt im Stammverzeichnis, warnt das Plugin, statt still nichts zu tun.

Auswahl von fünf Voreinstellungen, darunter eine Tabelle mit Crawler, Zweck und Regel-Auswahlfeld
robots.txt-Verwaltung mit Voreinstellungen und einer Regel je Crawler.

Dazu erzeugt das Plugin auf Wunsch eine llms.txt — automatisch aus deinen Inhalten oder von Hand kuratiert, mit Warnung, falls ein anderes Plugin bereits eine ausliefert.

Einstellungen für Modus, Inhaltstypen und Einleitungstext, darunter die erzeugte Datei als Vorschau
Der llms.txt-Generator mit Vorschau der aktuellen Ausgabe.

Eine ehrliche Einschätzung dazu: Wir halten llms.txt für überschätzt. Es ist eine Konvention, kein Standard, und Stand August 2026 dokumentiert keiner der großen Betreiber, dass er die Datei liest. Sie kostet nichts und ist nebenbei ein brauchbares Inhaltsverzeichnis der eigenen Website — mehr sollte man sich davon nicht versprechen. Was wirklich hilft, steht in llms.txt erklärt und in strukturierte Daten für KI.

Was das Plugin nicht kann

Der unangenehmste Befund beim Bauen war die Cache-Blindheit. Jeder Crawler-Zähler, der in PHP hängt, misst zu wenig, sobald ein Full-Page-Cache die Anfragen beantwortet — und das ist auf den meisten gepflegten WordPress-Installationen der Fall. Wir haben lange nach einem Weg drumherum gesucht und keinen gefunden, der ohne Serverzugriff auskommt. Also sagt es das Plugin einfach: Cache erkannt, Zahlen sind eine Untergrenze. Der Import von Server-Logfiles wäre die saubere Lösung und ist für später vorgesehen.

Ebenfalls nicht drin: Positionen in KI-Antworten, Wettbewerbsvergleiche und Zitat-Monitoring. Dafür gibt es den KI-Sichtbarkeits-Check auf dieser Seite, dessen Methodik offenliegt. Und die Frage, welche Maßnahmen überhaupt etwas bringen, beantwortet kein Plugin — dafür ist der Wissens-Hub da.

Was gespeichert wird

Von Crawler-Zugriffen: Zeitpunkt, Pfad, Statuscode, Verifikationsergebnis und ein gekürztes IP-Präfix. Vollständige IP-Adressen landen nie in der Datenbank. Von Besuchern aus KI-Antworten: der Name des verweisenden Dienstes und die Zielseite, sonst nichts.

Formular mit Schaltern für Crawler-Erfassung, Reverse-DNS-Prüfung, Aufbewahrungsdauer und Wochenbericht
Die Einstellungen: Datenerfassung, Berichte, Benachrichtigungen und Updates.

Einzelne Zugriffe werden nach einer einstellbaren Frist gelöscht (Voreinstellung 90 Tage), die anonymen Tagessummen bleiben. Beim Deinstallieren verschwinden Tabellen, Optionen und geplante Aufgaben rückstandslos, sofern du nichts anderes einstellst.

Welche Datenschutzregeln für dich gelten, hängt vom Land ab — das Plugin sagt das auch in seinen eigenen Einstellungen. Textbausteine für die Datenschutzerklärung bringt es mit, die Einschätzung bleibt bei dir. Wie wir es auf dieser Website halten, steht in unserer Datenschutzerklärung.