KI-Sichtbarkeit ist der Anteil der KI-Antworten, in denen deine Marke vorkommt, gemessen an einem festen Satz von Fragen. Sie ist eine Zahl, keine Position.
Diese Seite handelt von der Messung. Was du tust, damit sich die Zahl bewegt, steht auf der Seite zur GEO-Optimierung. Die Trennung hilft dir, Änderungen und ihre Ergebnisse auseinanderzuhalten.
Ich betreibe dafür einen eigenen Monitor: 25 Kauf-Prompts, bis zu neun Modelle, jeden Monat. Was hier steht, ist die Methode dahinter, aufgeschrieben so, dass du sie auch ohne mein Werkzeug nachbauen kannst.
Das Wichtigste in Kürze
Gemessen wird der Anteil der Antworten mit Nennung, nicht ein Platz von 1 bis 10.
Drei Werte pro Antwort reichen: wirst du genannt, stimmt die Aussage, wer wird stattdessen genannt.
Der Wortlaut der Fragen muss gleich bleiben. Wer jedes Mal anders fragt, misst die Frage statt die Seite.
Eine einzelne Abfrage ist kein Befund. Dieselbe Frage führt nicht zwangsläufig zur selben Antwort.
Ein Satz aus 20 bis 30 Fragen, monatlich gestellt, ergibt eine Zahl, die sich vergleichen lässt.
Warum eine Position hier nicht funktioniert
Für diese Messung zähle ich, in welchen Antworten dein Unternehmen genannt wird. Die Reihenfolge einer Suchergebnisliste ist dafür kein geeigneter Maßstab.
Ich halte pro Antwort fest, ob die Marke vorkommt. Über mehrere Fragen und Messläufe ergibt sich daraus ein Anteil, den ich verfolgen kann.
Was bleibt, ist eine Häufigkeit: in wie vielen von dreißig Antworten kommst du vor. Diese Häufigkeit kannst du bei gleichem Vorgehen über die Monate vergleichen.
Wie kann ich meine KI-Sichtbarkeit messen?
Mit einem festen Fragensatz, regelmäßig gestellt, und drei notierten Werten pro Antwort. Genau so läuft mein Monitor, nur automatisch.
Der Fragensatz. Zwanzig bis dreißig Fragen, die ein Käufer wirklich stellen würde. Nutze dafür die Formulierungen aus echten Erstgesprächen. Sinnvoll sind fünf Blöcke: Kategorie-Auswahl, Fakten über dich, Anwendungsfall, Kaufkriterien, direkter Vergleich mit deinen Wettbewerbern.
Die drei Werte. Notiere, ob du genannt wirst, ob die Angaben stimmen und welche Wettbewerber vorkommen. Vergleiche die Aussagen mit deinem aktuellen Angebot, damit dir alte Preise oder eingestellte Leistungen auffallen.
Der Rhythmus. Einmal im Monat reicht und ist besser als sporadisch. Wichtig ist, dass Wortlaut und Zeitpunkt stabil bleiben. Ich messe monatlich, weil kürzere Abstände vor allem Rauschen zeigen.
Kostenloser Check
Bevor du misst, prüf die Technik. Der Check hilft dir, technische Abrufprobleme zu erkennen, bevor du die Antworten auswertest.
Share of Answer ist der Anteil der Vergleichsfragen, in denen du genannt wirst, direkt neben demselben Wert für jeden Wettbewerber.
Ein Rechenbeispiel: Bei dreißig Fragen kommst du in acht Antworten vor. Das sind rund 27 Prozent. Zwölf Nennungen im Folgemonat wären 40 Prozent. Ob eine Änderung an der Website die Ursache ist, lässt sich daraus allein noch nicht ablesen. Der Wert wird erst im Vergleich aussagekräftig: "Wettbewerber A wird in 80 Prozent der Vergleiche genannt, du in 40" sagt mehr als jede absolute Zahl.
Daneben lohnt eine zweite Größe: die offenen Lücken. Das sind Fragen, die kein Modell über dich beantworten konnte. Diese Liste hilft mir, Themen für die nächsten Artikel auszuwählen.
Zum Vergrößern tippen
Warum empfiehlt ChatGPT meine Marke nicht?
Weil auf deiner Seite kein Satz steht, der die gestellte Frage beantwortet, oder weil die Seite den Abruf gar nicht erreicht.
Diese beiden Ursachen sehen von außen gleich aus und brauchen völlig verschiedene Maßnahmen. Ein schneller Trenntest: frag ein Modell direkt nach deiner Domain, nicht nach deiner Kategorie. Kommt eine brauchbare Beschreibung zurück, bist du erreichbar und lesbar, und das Problem liegt beim Text. Kommt nichts oder etwas offensichtlich Falsches, liegt es an der Zustellung.
Eine dritte Ursache ist Positionierung. Fragen nach einer Kategorie mit zehn großen, bekannten Anbietern werden mit diesen zehn beantwortet. Das ist kein technisches Problem. Die Antwort darauf ist eine engere Frage, bei der du die naheliegende Wahl bist.
Von ChatGPT empfohlen werden
Empfohlen wird, wer die Frage beantwortet und dessen Angaben überprüfbar sind. Beides muss im abrufbaren Text stehen.
Konkret heißt das: für jede Frage ein eigener Abschnitt, Überschrift ist die Frage, erster Satz ist die Antwort. Schreibe die Antwort direkt unter die Überschrift und ergänze danach die Erklärung.
Was zusätzlich zählt, ist Genauigkeit. Zwei Seiten, die dasselbe sagen, führen dazu, dass die bekanntere genannt wird, und das ist im Zweifel nicht deine. Der einzige verlässliche Vorteil ist eine Angabe, die sonst niemand machen kann: eine Zahl aus deinem Betrieb, ein Fall, den du begleitet hast, ein Ablauf, den du wirklich so fährst.
In Claude gefunden werden
Die technische Grundlage ist dieselbe wie bei ChatGPT, die Zusammensetzung der Antworten ist es nicht. Deshalb lohnt es, mehr als ein System zu messen.
Perplexity arbeitet sichtbar mit Quellen und nennt sie neben der Aussage. Systeme, die ihre Antwort als geschlossenen Text formulieren, nennen Quellen sparsamer. Dort ist die Nennung deines Namens im Fließtext wertvoller als der Link.
Ein zweiter Unterschied betrifft die Sprache. Eine Frage auf Deutsch führt zu anderen Quellen als dieselbe Frage auf Englisch, auch bei identischem Thema. Wer im deutschsprachigen Markt verkauft, misst auf Deutsch.
Agent Readiness: die technische Vorstufe
Agent Readiness beschreibt, ob ein Agent deine Domain finden, verstehen und dort etwas auslösen kann. Sie ist die Voraussetzung, nicht das Ergebnis.
Der Unterschied zur Sichtbarkeit ist wichtig. Agent Readiness lässt sich technisch prüfen und hat eine eindeutige Antwort. Sichtbarkeit lässt sich nur beobachten und schwankt. Wer die Vorstufe nicht bestanden hat, braucht mit dem Messen gar nicht anzufangen: er misst dann nur, dass er nicht abrufbar ist.
Deshalb habe ich zuerst den Check gebaut und danach den Monitor. Mehr dazu steht über mich.
Häufige Fragen
Wie viele Fragen brauche ich für eine belastbare Messung?
Zwanzig bis dreißig. Weniger schwankt zu stark, mehr kostet Aufwand ohne zusätzliche Aussage. Wichtiger als die Anzahl ist, dass der Wortlaut über die Monate gleich bleibt.
Warum bekomme ich bei derselben Frage unterschiedliche Antworten?
Das liegt in der Natur dieser Systeme. Deshalb ist eine einzelne Abfrage kein Befund. Erst ein fester Fragensatz, mehrfach gestellt, ergibt ein Bild, mit dem man arbeiten kann.
Reicht es, ChatGPT zu messen?
Für den Anfang ja. Sobald du etwas änderst, lohnt der Blick auf mehrere Systeme, weil ein Rückgang im einen und ein Anstieg im anderen sonst unbemerkt bleibt.
Was mache ich mit den offenen Lücken?
Das ist dein Redaktionsplan. Jede Frage, die kein Modell über dich beantworten konnte, ist ein Abschnitt, den es auf deiner Seite noch nicht gibt.
Kann ich das von Hand messen?
Ja, und für den ersten Befund ist das sogar sinnvoll, weil du dabei ein Gefühl für die Antworten bekommst. Ab dem zweiten Monat wird es mühsam, weil Wortlaut und Zeitpunkt stabil bleiben müssen.
Fazit
KI-Sichtbarkeit ist eine Häufigkeit, keine Position, und sie wird erst im Verlauf aussagekräftig. Ein fester Fragensatz, drei notierte Werte pro Antwort und ein monatlicher Rhythmus reichen aus. Wer vorher nicht geprüft hat, ob seine Seite überhaupt abrufbar ist, misst am falschen Ende.
Was sagen die Modelle heute über dich?
Prüfe zunächst die technische Zugänglichkeit deiner Website. Der Check sagt dir in zwei Minuten, ob deine Domain überhaupt in Frage kommt.