Statistikwerk

Welche KI-Crawler lesen Deine Webseite?

KI-Assistenten beantworten Fragen mit Inhalten aus dem Internet, auch mit Deinen. Dafür schicken die Anbieter eigene Programme vorbei, die Deine Seiten lesen. Hier erfährst Du, welche das sind und wie Du sie sichtbar machst.

Team Statistikwerk Aktualisiert am 6. Oktober 2026 4 Min. Lesezeit Auch auf: English, Français, Italiano, Español

Kurz gesagt

KI-Crawler lesen Deine Seiten für das Training, für die KI-Suche oder für eine einzelne Frage. Weil sie kein JavaScript ausführen, sieht eine normale Webstatistik sie nicht. Statistikwerk zählt sie mit dem WordPress-Plugin oder einem PHP-Baustein. In der robots.txt legst Du fest, wer lesen darf.

Inhalt
  1. Drei Arten von KI-Crawlern
  2. Warum eine normale Webstatistik sie nicht sieht
  3. So zählt Statistikwerk KI-Crawler
  4. Besucher aus KI-Assistenten
  5. robots.txt: Wer darf lesen?
  6. llms.txt: eine Zusammenfassung für KI
  7. Häufige Fragen

Drei Arten von KI-Crawlern

Nicht jeder KI-Crawler will dasselbe. Statistikwerk teilt sie in drei Arten ein:

Art Wozu Beispiele
Training Texte sammeln, um KI-Modelle zu trainieren GPTBot (OpenAI), ClaudeBot (Anthropic), CCBot (Common Crawl), meta-externalagent (Meta)
KI-Suche Seiten für die Suche im KI-Assistenten finden, ähnlich wie Google OAI-SearchBot (OpenAI), Claude-SearchBot (Anthropic), PerplexityBot
Abruf für eine Frage eine Seite lesen, weil jemand gerade danach fragt ChatGPT-User, Claude-User, Perplexity-User

Für Deine Sichtbarkeit zählen vor allem die Suche und der Abruf. Hier holt sich ein KI-Assistent Deine Seite, um sie in einer Antwort zu nennen oder zu verlinken.

Warum eine normale Webstatistik sie nicht sieht

Webstatistiken wie Statistikwerk oder Google Analytics zählen über ein kleines Script, das im Browser läuft. KI-Crawler laden zwar Deine Seite, führen aber kein JavaScript aus. In der Statistik tauchen sie darum nicht auf, auch wenn sie jeden Tag vorbeikommen.

So zählt Statistikwerk KI-Crawler

Damit Statistikwerk die Crawler sieht, muss die Zählung direkt auf Deinem Server laufen:

  • WordPress: Das Plugin zählt die Abrufe auf Deinem Server und meldet sie einmal pro Stunde. Das Plugin muss mit Statistikwerk verbunden und die Zählung in seinen Einstellungen eingeschaltet sein.
  • Andere Webseiten mit PHP: In der Einrichtung unter «KI-Crawler zählen» lädst Du einen kleinen PHP-Baustein herunter. Du bindest ihn in die index.php ein, bei reinen HTML-Seiten über die .htaccess.
  • Baukästen wie Wix, Jimdo oder Shopify: Dort lässt sich kein eigener Code auf dem Server ausführen. KI-Crawler kann Statistikwerk hier leider nicht zählen.

Die Zahlen findest Du in der Statistik in der Karte «KI-Sichtbarkeit» unter «Abrufe durch KI-Crawler»: nach Art, nach Crawler und mit den Seiten, die am häufigsten gelesen werden.

Besucher aus KI-Assistenten

Neben den Crawlern gibt es Menschen, die in ChatGPT, Perplexity, Claude, Gemini oder Copilot auf einen Link zu Deiner Seite klicken. Diese Besucher zählt das normale Script. Statistikwerk zeigt sie als eigenen Kanal «KI-Assistenten», ebenfalls in der Karte «KI-Sichtbarkeit», mit ihrem Anteil an allen Besuchern und den Seiten, auf denen sie ankommen.

robots.txt: Wer darf lesen?

Die Datei robots.txt im Hauptverzeichnis Deiner Webseite sagt Crawlern, was sie lesen dürfen. Seriöse Anbieter halten sich daran. Ein Beispiel, das das Training verbietet und die KI-Suche erlaubt:

User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: OAI-SearchBot
Allow: /

Für die KI von Google gibt es die Bezeichnung «Google-Extended». Sie regelt nur die Nutzung für KI, die normale Google-Suche bleibt davon unberührt.

Überleg Dir gut, wen Du sperrst. Wer die Such-Crawler aussperrt, wird in KI-Antworten seltener genannt. Manche Hoster und Dienste wie Cloudflare sperren KI-Crawler inzwischen von sich aus. Ein Blick in Deine robots.txt lohnt sich: Du findest sie unter Deine-Domain/robots.txt.

Tipp: Der KI-Schnellcheck prüft Deine robots.txt für alle wichtigen Crawler, testet, ob eine Firewall KI-Crawler abweist, und zeigt, was Du verbessern kannst. Gratis und ohne Anmeldung.

llms.txt: eine Zusammenfassung für KI

Die llms.txt ist ein noch junger Vorschlag: eine einfache Textdatei im Hauptverzeichnis, die KI-Systemen in wenigen Sätzen erklärt, worum es auf Deiner Webseite geht und wo die wichtigsten Seiten liegen. Ein offizieller Standard ist sie nicht, und ob die grossen Anbieter sie lesen, ist offen. Der Aufwand ist aber klein. Statistikwerk hat selbst eine, unter statistikwerk.ch/llms.txt.

Häufige Fragen

Soll ich KI-Crawler aussperren?

Das hängt davon ab, was Dir wichtiger ist. Willst Du nicht, dass Deine Texte ins Training fliessen, sperrst Du die Training-Crawler. Willst Du in KI-Antworten vorkommen, lässt Du die Such- und Abruf-Crawler zu.

Warum sehe ich keine KI-Crawler, obwohl das Plugin verbunden ist?

Prüfe zuerst, ob die Zählung in den Plugin-Einstellungen eingeschaltet ist. Liefert ein Cache-Plugin Deine Seiten aus, ohne WordPress zu starten, sieht das Plugin diese Abrufe nicht. Und manchmal kommen einfach noch keine: Neue oder kleine Webseiten besuchen die Crawler seltener.

Kann sich ein Programm als KI-Crawler ausgeben?

Ja. Statistikwerk erkennt Crawler an ihrer Kennung, dem User-Agent, und diese Kennung kann jeder Abruf vortäuschen. Für einen Überblick reicht das, als Beweis taugt es nicht.

Artikel teilen: E-Mail LinkedIn Telegram X

Probier es mit Deiner eigenen Webseite aus.

Kostenlos, ohne Kreditkarte, in zwei Minuten eingerichtet.

Kostenlos starten