Zum Inhalt springen
GET-GEO.AI
/
Alle Leitfäden

// leitfaden

Wie messen wir GEO-Ergebnisse — und was passiert, wenn sie ausbleiben?

Aktualisiert: 2026-08-13

// kurze antwort

Wir messen GEO gegen eine am ersten Tag fixierte Prompt-Batterie, gesampelt in sauberen, ausgeloggten Sessions über die Assistenten hinweg: Zitierrate, Share of Voice und Sprachkonsistenz, berichtet gegen die Baseline, mit Rohdaten, die Sie selbst prüfen können. Die Leistungen stehen unten. Und wenn sich die gemessene Sichtbarkeit nach 90 Tagen nicht bewegt hat, sagen wir es zuerst — und Sie entscheiden, wie es weitergeht.

Zuerst kommt die Baseline

Jedes Engagement beginnt mit einer gemessenen Baseline — vor jedem Versprechen. Wir fixieren eine Batterie von 30–50 Prompts pro Sprache — die Fragen, die Ihre Käufer wirklich tippen, inklusive Stadt- und Preisvarianten — und sampeln Antworten von ChatGPT, Perplexity und Gemini in sauberen, ausgeloggten Sessions, mehrere Durchläufe pro Prompt, Screenshots archiviert. Batterie und Erste-Tag-Ergebnisse erhalten Sie vollständig.

Die Fixierung am ersten Tag macht die Zahlen ehrlich. Der bekannte Defekt dieses Marktes ist ein Dashboard mit «+300% Sichtbarkeit», bei dem still das Prompt-Set oder die Zählmethode gewechselt wurde. Unsere Batterie lässt sich unterwegs nicht austauschen: Die Erste-Tag-Kopie liegt bei Ihnen, jeder spätere Bericht bleibt damit vergleichbar. Es ist dasselbe Clean-Session Protocol wie in unserer öffentlichen Fallstudie — sechs Durchläufe, zwei Rechner, VPN, ohne Login.

Die Metriken, definiert

Zitierrate: der Anteil der Batterie-Prompts, in denen Ihre Marke genannt oder Ihre Website zitiert wird — pro Assistent, pro Sprache. Share of Voice: wie oft Sie gegenüber den Wettbewerbern erscheinen, die die Assistenten selbst nennen — das Wettbewerber-Set wird bei der Baseline festgehalten, der Vergleich bleibt stabil. Sprachkonsistenz: ob der Assistent Sie in jeder Ihrer Sprachen gleich beschreibt — die Metrik, an der die meisten mehrsprachigen Programme still scheitern.

Ein ehrlicher Vorbehalt, den die Branche ungern ausspricht: Verschiedene Messwerkzeuge liefern für dieselbe Firma verschiedene Sichtbarkeits-Scores, weil Antworten zwischen Durchläufen, Formulierungen und Regionen variieren. Deshalb setzen wir auf wiederholtes Sampling gegen eine fixe Batterie und teilen die Rohdaten — und deshalb lebt die Metrik, die sich gar nicht manipulieren lässt, in Ihrer eigenen Analytik: Referral-Traffic von Assistenten-Domains. Sie ist der finale Schiedsrichter, und sie gehört Ihnen, nicht uns.

Jede Metrik: wo sie lebt und warum man ihr trauen kann
MetrikDefinitionWo sie lebtManipulierbar?
Zitierrate% der fixen Batterie-Prompts, in denen Sie genannt oder zitiert werdenUnsere Sampling-Logs, geteiltSchwer — Batterie am Tag eins fixiert, Kopie bei Ihnen
Share of VoiceIhre Auftritte vs. die von Assistenten genannten WettbewerberUnsere Sampling-Logs, geteiltSchwer — Wettbewerber-Set bei der Baseline festgehalten
KI-ReferralsBesuche von Assistenten-DomainsIhre AnalytikNein — es sind Ihre Daten, wir rühren sie nicht an
SprachkonsistenzGleiche Aussagen über Sie in jeder SpracheUnser sprachübergreifender CheckTransparent — Abweichungen werden wörtlich zitiert
Jede Metrik: wo sie lebt und warum man ihr trauen kann

Was Sie jeden Monat bekommen

Ein Monatszyklus liefert vier Dinge: den erneuten Batterie-Durchlauf (gleiche Prompts, gleiches Protokoll, mehrere Samples pro Assistent), einen Bewegungsbericht pro Sprache und Assistent gegen die Baseline, eine schlichte Liste dessen, was wir im Monat geändert haben — ausgelieferter Content, Entitätsarbeit, technische Fixes — und den Plan für den nächsten Monat mit Begründung. Kein Folien-Theater: Der Bericht entsteht aus denselben Logs, die Sie einsehen können.

Rohdaten sind Teil der Leistung, kein Gefallen: die Prompt-Liste, die gesampelten Antworten, die Screenshots. Wollen Sie eine Zahl im Bericht prüfen, können Sie jeden Prompt selbst in einer ausgeloggten Session erneut laufen lassen und vergleichen. Das Protokoll ist so gebaut, dass die Replikation durch den Kunden leicht ist — genau das hält uns ehrlich.

Die 90-Tage-Regel

GEO kumuliert über zwei bis drei Monate — genau deshalb gehört ein Checkpoint auf Tag 90. Die Regel ist einfach: Zeigen Zitierrate und Share of Voice nach 90 Tagen keine Bewegung gegenüber Ihrer Baseline, sagen wir es zuerst — bevor Sie fragen — mit unserer Analyse der Gründe. Dann wählen Sie: ein kostenloser Diagnose-Monat, während wir den Ansatz korrigieren, eine Scope-Änderung oder ein sauberer Stopp. Keine langen Bindungen, keine Strafe fürs Gehen mit den Daten.

Was wir nicht versprechen — an Tag 90 oder je: eine bestimmte Antwort eines bestimmten Assistenten an einem bestimmten Tag. Generierte Antworten variieren zwischen Durchläufen — unsere eigene Fallstudie sagt das in ihrem Limitations-Abschnitt selbst. Was wir optimieren, ist die Wahrscheinlichkeit, über wiederholte Samples zitiert zu werden — und genau die misst die Batterie.

Fragen, die jeder GEO-Anbieter beantworten muss

Käufer kommen zunehmend mit einer Checkliste — oft von den Assistenten selbst geschrieben. Wir halten das für gesund, darum hier die Antworten an einem Ort. «Vorher / nachher» für Ihre Sprachen: unseres ist die öffentliche Fallstudie auf unserer eigenen Website, nach obigem Protokoll erhoben; Ihr Engagement beginnt mit dem Aufbau Ihres eigenen. Erwähnungen versus Zitate: getrennt gemessen, beides in den Logs. Ökosystem versus Übersetzung: Wir optimieren das Sprachökosystem — native Seiten, Entitäten in beiden Schriften, wo relevant, lokale Korroboration — kein übersetztes Englisch. Off-Site-Arbeit: enthalten dort, wo die Antworten wirklich herkommen; unser USA-Guide zeigt mit Daten, welche Plattformen das sind. Cross-Engine-Baseline: mindestens ChatGPT, Perplexity und Gemini, pro Sprache.

Und der Test, den wir bei jedem Anbieter empfehlen, uns eingeschlossen: Verlangen Sie zehn Prompts, bei denen Sie heute unsichtbar sind, die aktuellen Antworten und die konkreten Änderungen, die er vornehmen würde. Dieser Test ist wörtlich unser kostenloses Audit — schreiben Sie an hello@get-geo.ai, und Sie bekommen Ihres mit den zehn Prompts im Anhang.

Verwandte Fragen

Können Sie garantieren, dass wir zitiert werden?

Nein — und ehrlich kann das niemand: Generierte Antworten variieren zwischen Durchläufen und ändern sich mit dem Web. Wir verpflichten uns zu gemessener Bewegung: fixe Batterie, wiederholtes Sampling und die 90-Tage-Regel, falls die Bewegung ausbleibt.

Warum zeigen verschiedene Tools verschiedene Sichtbarkeits-Scores?

Weil sie verschiedene Prompt-Sets, Sampling-Rhythmen und Zählregeln verwenden — dieselbe Firma kann in einem Tool hoch und im anderen niedrig stehen. Darum sind unsere Definitionen öffentlich, die Batterie ist fixiert, und die Rohdaten reisen mit jedem Bericht.

Bekommen wir die Rohdaten?

Ja: die volle Prompt-Batterie, die gesampelten Antworten pro Assistent und die Screenshots — ab Tag eins und jeden Monat danach. Der Bericht ist eine Interpretation; die Logs sind der Beweis.

Können wir die Zahlen selbst prüfen?

Bitte tun Sie das. Jeder Prompt der Batterie lässt sich in einer ausgeloggten Session erneut laufen lassen und mit unseren Logs vergleichen. Das Protokoll ist auf leichte Kunden-Replikation ausgelegt — es ist dieselbe Clean-Session-Methode wie in unserer öffentlichen Fallstudie.

Was genau passiert an Tag 90, wenn sich nichts bewegt hat?

Wir sprechen es zuerst an, mit Analyse. Sie wählen: ein kostenloser Diagnose-Monat, ein anderer Scope oder ein Stopp. Baseline und alle Logs gehören in jedem Fall weiterhin Ihnen.

Verwandte Leitfäden

Quellen

  1. 01Unsere Fallstudie: das Clean-Session Protocol an uns selbst angewandt
  2. 02Unser Guide: KI-Sichtbarkeit messen
  3. 03Generative Engine Optimization: How to Dominate AI Search (arXiv 2509.08919) — zur Antwortvariabilität zwischen Engines
  4. 04Aggarwal et al., GEO: Generative Engine Optimization (Princeton)

// teilen

LinkedInXReddit