Wie die AI Daten auf deiner Seite sammelt, und welchen Traffic du wirklich siehst
Fünf Arten von AI-Traffic, das Crawl-zu-Klick-Verhältnis, und warum Last-Click-Attribution den Beitrag der AI unsichtbar macht. Von der ersten Zeile Markup bis zum attribuierten Kauf.
Während du das liest, besuchen AI-Bots deine Seite. Nicht einmal, sondern laufend, und die meisten geben dir nie einen Klick zurück. Sie lesen, lernen, zitieren und reichern an. Das Problem: In Google Analytics siehst du davon fast nichts, weil AI-Crawler kein JavaScript ausführen. Was am Server ankommt, ist die ganze Wahrheit, und die ist überraschend.
Fünf Arten, wie die AI deine Seite besucht
AI-Traffic ist nicht ein Ding. Es sind mindestens fünf verschiedene Absichten, und jede bedeutet etwas anderes für dich:
Klasse | Beispiel-Bots | Was passiert | Was es bedeutet |
|---|---|---|---|
Standard-Crawl (Training) | GPTBot, ClaudeBot, CCBot, Google-Extended | Schluckt Inhalte fürs Modell, breit und periodisch | Du landest im Modell-Wissen, aber ohne Live-Bezug |
On-Demand-Recherche | ChatGPT-User, OAI-SearchBot, Perplexity-User | Holt live, weil jemand gerade eine Frage stellt | Deine Seite wird für eine konkrete Antwort geprüft |
Deep Research | Burst derselben On-Demand-Bots | Viele Seiten am Stück für einen Report | Jemand recherchiert dich tief und mehrstufig |
Zitation | Die Untermenge mit Link in der Antwort | Landet sichtbar in der Antwort, seltener Klick | Der eigentliche Referral, der Rest ist stiller Konsum |
Anreicherung / Agenten | Amazonbot (Rufus), Applebot-Extended (Apple Intelligence, Siri) | Reichert Produkt- und Firmendaten für Assistenten und Voice an | Deine Daten fließen in Kauf-Agenten und Sprach-Antworten |
Ein Trainings-Crawl ist etwas völlig anderes als jemand, der dich gerade aktiv in einer Deep Research untersucht. Wer beides in einen Topf wirft, versteht seinen AI-Traffic nicht.
Nicht alles ist AI, trenne das Rauschen
Neben den AI-Bots kommt viel Traffic, der nichts mit AI zu tun hat, und der deine Zahlen verfälscht, wenn du ihn mitzählst:
SEO-Tools: AhrefsBot, SemrushBot und Co. crawlen für Backlink- und Keyword-Indizes, nicht für AI-Antworten.
Wettbewerber-Monitoring: Werkzeuge, mit denen andere dich beobachten.
Scraper und Spam: oft aus Datacenter-Ranges, die Inhalte abgreifen, ohne dir je etwas zu bringen.
Und ehrlich gesagt: unsere eigenen Klariton-Scans, die bei der Arbeit mit dir entstehen (Checks, Verifikation), zählen wir nicht in deine Reach-Zahlen. Sonst würdest du deine eigene Messung verfälschen. Sauberer AI-Reach heißt: AI-Bots ja, SEO-Tools, Spam und unser eigenes Werkzeug raus.
So erkennst du die Muster in deinen Logs
Diese Signale stehen in deinen Server-Logs, nicht in Google Analytics (das lädt per JavaScript, das der Bot nie startet). Der Schlüssel ist der User-Agent jedes Requests. In einem Log sieht ein AI-Besuch etwa so aus:
203.0.113.7 [21/Jul/2026] "GET /produkt/xy" 200
"Mozilla/5.0 (compatible; ChatGPT-User/1.0; +https://openai.com/bot)"Die Kennung im User-Agent, hier ChatGPT-User, verrät Absender und Absicht. Die wichtigsten Kennungen, Stand Juli 2026 (sie ändern sich, prüfe sie regelmäßig):
User-Agent enthält | Wer und Klasse | Was es bedeutet |
|---|---|---|
GPTBot | OpenAI · Training | Fürs Modell, breit und periodisch |
OAI-SearchBot, ChatGPT-User | OpenAI · On-Demand | Holt live für eine konkrete Antwort |
PerplexityBot | Perplexity · Training | Fürs Modell |
Perplexity-User | Perplexity · On-Demand | Live für eine Antwort |
ClaudeBot | Anthropic · Training | Fürs Modell |
Claude-User | Anthropic · On-Demand | Live für eine Antwort |
Google-Extended | Google · Training | Für Gemini-Training |
Amazonbot | Amazon (Rufus, Alexa) · Anreicherung | Reichert Produktdaten an |
Applebot-Extended | Apple (Apple Intelligence, Siri) · Anreicherung | Für Assistenten und Voice |
AhrefsBot, SemrushBot | SEO-Tool · KEIN AI | Rausfiltern, verfälscht sonst deine AI-Zahlen |
Aus einzelnen Zeilen wird ein Muster, wenn du die Zeit dazunimmst: mehrere On-Demand-Kennungen (ChatGPT-User, Perplexity-User) in wenigen Minuten auf verschiedenen Seiten heißt Deep Research, jemand recherchiert dich gerade tief. Leere oder generische User-Agents (python-requests, curl) aus reinen Datacenter-Ranges sind dagegen Scraper-Rauschen und zählen nicht als AI. Genau diese Trennung nimmt dir das Agentic-Reach-Modul ab, damit du nicht selbst Logs lesen musst.
Viel gelesen, selten geklickt
Cloudflare hat es mit Zahlen belegt (Crawl-to-Click-Gap, Juli 2025): das Verhältnis von Crawls zu zurückgeschickten Klicks ist dramatisch. Anthropic kam auf rund 38.000 Crawls pro einem Besucher, OpenAI auf etwa 1.100, Perplexity auf knapp 200. Deine Inhalte werden also massiv konsumiert, aber die AI hält den Nutzer in ihrer eigenen Antwort, statt ihn zu dir zu schicken.
Deine Marke kann in der AI hundertfach gelesen werden, lange bevor sie einen Klick sieht. Wer nur Klicks misst, hält das für Stille.
Das ist keine schlechte Nachricht, sondern eine unsichtbare. Sichtbarkeit in der AI passiert, ob du es misst oder nicht. Die Frage ist nur, ob du es siehst.
Sichtbarkeit ist nicht das Ziel, der Kauf ist es
Gelesen zu werden ist der Anfang der Kette, nicht das Ende. Die volle Kette geht: Crawl → Zitation → Klick → Kauf. Jede Stufe verliert Volumen, und jede Stufe ist eine eigene Messung. Nur die letzte zahlt deine Rechnung.
Crawl: Wie oft und von welchem Bot wird deine Seite gelesen?
Zitation: Landest du in der Antwort, oder nur im stillen Konsum?
Klick: Führt die Zitation zu einem echten Besuch?
Kauf: Wird aus dem Besuch ein Abschluss, im Shop?
Die meisten Tools messen die erste Stufe und nennen es Erfolg. Aber ein Crawl ist kein Umsatz. Erst wenn du die Kette bis zum Kauf durchziehst, weißt du, was AI-Sichtbarkeit dir wirklich bringt.
Warum Last-Click die AI unsichtbar macht
Hier liegt der teuerste Messfehler. AI ist fast immer der erste Kontakt, die Entdeckung im Upper Funnel. Der Kunde fragt die AI, findet dich, kommt aber erst beim zweiten oder dritten Besuch über Google oder direkt zurück und kauft dann. Miss du per Last-Click, bekommt AI null Kredit, der Kauf sieht aus, als käme er von Google.
So unterschätzt heute praktisch jeder den Beitrag der AI. Richtig ist eine anteilige, Multi-Touch-Attribution: erster Besuch via AI-Referral, zweiter via Google, dritter direkt, und AI bekommt seinen fairen Anteil an der Kette, statt aus der Statistik zu verschwinden.
AI ist der erste Touch. Last-Click löscht ihn. Anteilige Attribution bringt ihn zurück.
Was du davon messen kannst
Weil AI-Crawler kein JavaScript ausführen, muss die Messung server-seitig passieren, am Edge, bevor irgendein Skript läuft. Genau da setzt Klaritons Agentic-Reach-Modul an:
Welcher Bot welche Seite gelesen hat, in Echtzeit, sauber nach Absicht getrennt (Training, On-Demand, Deep Research).
Aktive Recherche: ein Burst von On-Demand-Reads heißt, jemand untersucht dich gerade, und das Thema der Seiten verrät die Absicht.
Bis zum Umsatz: First-Touch-Erfassung und Session-Gruppierung über die Zeit, damit ein AI-Erstkontakt nicht verloren geht, wenn der Kauf später über einen anderen Kanal kommt.
Der kostenlose Klariton-Check zeigt dir den Einstieg: sehen und zitieren dich ChatGPT, Perplexity, Gemini und Claude überhaupt? Der Rest der Kette, von der Recherche bis zum attribuierten Kauf, ist genau das, was Agentic Reach sichtbar macht, während andere beim Crawl-Zählen stehen bleiben.
Stell deine Frage zu Klariton.
Gegroundet in Klaritons eigenem Wissen, belegt statt erfunden.
Wie sichtbar ist deine Marke für AI?
Der kostenlose AI-Visibility-Check zeigt dir in unter einer Minute, wie AI-Assistenten deinen Shop heute sehen.