ArticleMessung
Umsetzung
Monitoring
Wer nur Sitzungen zählt, sieht bei wachsender Sichtbarkeit in KI-Systemen eine fallende Kurve. Es braucht eine zweite Messebene, und sie muss reproduzierbar sein, sonst ist sie ein Bauchgefühl mit Tabelle.
Article3 Ebenen
Drei Ebenen, die sich ergänzen
- Prompt-Tests
- Ein fester Katalog realistischer Fragen, in mehreren Systemen gestellt, in festem Rhythmus wiederholt und protokolliert. Erfasst wird, ob die Marke erwähnt und ob sie verlinkt wird.
- Verweissegmentierung
- Verkehr aus KI-Systemen als eigenes Segment in der Webanalyse, getrennt nach Quelle. Zeigt Volumen und Verhalten der Besucher, die tatsächlich klicken.
- Serverlogs
- Auswertung nach Crawler-Kennung. Zeigt, welches System wie oft abruft — und ob es überhaupt durchkommt.
ArticleVerfahren
Was ein belastbarer Prompt-Test braucht
- Denselben Fragenkatalog über den gesamten Beobachtungszeitraum
- Frische Sitzung ohne Verlauf und ohne persönliche Anpassung
- Mehrere Systeme, weil sich die Antworten stark unterscheiden
- Protokoll mit Datum, System, Frage und wörtlicher Antwort
- Feste Auswertung: erwähnt, verlinkt oder gar nicht vorgekommen
Der wichtigste Punkt ist die frische Sitzung. Wer im eigenen, über Monate gewachsenen Verlauf testet, misst die eigene Nutzungsgeschichte und nicht die Sichtbarkeit der Marke.
ArticleGrenzen
Was diese Messung nicht kann
Generative Antworten schwanken. Dieselbe Frage kann in zwei Sitzungen unterschiedliche Quellen nennen, ohne dass sich an der Website etwas geändert hätte. Einzelmessungen sind deshalb wertlos — aussagekräftig wird erst die Entwicklung über mehrere Zeitpunkte hinweg.
Ebenso wenig lässt sich messen, wie oft eine Marke in einer Antwort auftaucht, ohne dass jemand danach gefragt hat. Ein Teil der Wirkung bleibt strukturell unsichtbar, und wer etwas anderes behauptet, verkauft eine Schätzung als Messwert.