// guide
Comment mesurons-nous les résultats GEO — et que se passe-t-il s'ils ne viennent pas ?
Mis à jour: 2026-08-13
// réponse courte
Nous mesurons le GEO contre une batterie de prompts fixée au premier jour, échantillonnée en sessions propres et déconnectées à travers les assistants : taux de citation, part de voix et cohérence linguistique, rapportés contre la baseline, avec des logs bruts que vous pouvez vérifier. Les livrables sont listés ci-dessous. Et si la visibilité mesurée n'a pas bougé après 90 jours, nous le disons les premiers — et c'est vous qui décidez de la suite.
La baseline d'abord
Chaque mission commence par une baseline mesurée — avant toute promesse. Nous fixons une batterie de 30 à 50 prompts par langue — les questions que vos acheteurs tapent réellement, variantes par ville et par prix comprises — et nous échantillonnons les réponses de ChatGPT, Perplexity et Gemini en sessions propres et déconnectées, plusieurs passages par prompt, captures archivées. La batterie et les résultats du premier jour vous sont remis en intégralité.
Fixer la batterie au premier jour, c'est ce qui rend les chiffres honnêtes. Le défaut connu de ce marché, c'est le dashboard affichant « +300% de visibilité » après un changement discret du jeu de prompts ou de la méthode de comptage. Notre batterie ne peut pas être remplacée en cours de route : la copie du premier jour est chez vous, chaque rapport ultérieur lui reste comparable. C'est le même Clean-Session Protocol que dans notre étude de cas publique — six essais, deux machines, un VPN, sans connexion.
Les métriques, définies
Taux de citation : la part des prompts de la batterie où votre marque est nommée ou votre site cité dans la réponse — par assistant, par langue. Part de voix : votre fréquence d'apparition face aux concurrents que les assistants nomment eux-mêmes — le jeu de concurrents est consigné à la baseline, la comparaison reste stable. Cohérence linguistique : l'assistant vous décrit-il de la même façon dans chacune de vos langues — la métrique sur laquelle la plupart des programmes multilingues échouent en silence.
Une réserve honnête que le secteur évite de formuler : des outils de mesure différents produisent des scores de visibilité différents pour la même entreprise, car les réponses varient entre passages, formulations et régions. C'est pourquoi nous misons sur l'échantillonnage répété contre une batterie fixe et partageons les logs bruts — et c'est pourquoi la métrique impossible à truquer vit dans votre propre analytics : le trafic référent des domaines d'assistants. Nous la traitons comme l'arbitre final, et elle est à vous, pas à nous.
| Métrique | Définition | Où elle vit | Truquable ? |
|---|---|---|---|
| Taux de citation | % des prompts de la batterie fixe où vous êtes nommé ou cité | Nos logs d'échantillonnage, partagés | Difficile — batterie fixée au premier jour, copie chez vous |
| Part de voix | Vos apparitions vs les concurrents nommés par les assistants | Nos logs d'échantillonnage, partagés | Difficile — jeu de concurrents consigné à la baseline |
| Référents IA | Visites venant des domaines d'assistants | Votre analytics | Non — ce sont vos données, nous n'y touchons jamais |
| Cohérence linguistique | Les mêmes affirmations sur vous dans chaque langue | Notre contrôle inter-langues | Transparent — les écarts sont cités mot pour mot |
Ce que vous recevez chaque mois
Un cycle mensuel livre quatre choses : la batterie relancée (mêmes prompts, même protocole, plusieurs échantillons par assistant), un rapport de mouvement par langue et par assistant contre la baseline, la liste simple de ce que nous avons changé dans le mois — contenu publié, travail d'entité, corrections techniques — et le plan du mois suivant, motivé. Pas de théâtre de slides : le rapport est construit à partir des mêmes logs que vous pouvez inspecter.
Les données brutes font partie du livrable, pas d'une faveur : la liste de prompts, les réponses échantillonnées, les captures. Pour vérifier n'importe quel chiffre du rapport, relancez n'importe quel prompt vous-même en session déconnectée et comparez. Le protocole est conçu pour que la réplication par le client soit facile — c'est exactement ce qui nous garde honnêtes.
La règle des 90 jours
Le GEO se cumule sur deux à trois mois — c'est précisément pourquoi un point de contrôle se place au jour 90. La règle est simple : si le taux de citation et la part de voix ne montrent aucun mouvement contre votre baseline après 90 jours, nous le disons les premiers — avant que vous ne demandiez — avec notre analyse des causes. Ensuite, vous choisissez : un mois de diagnostic gratuit pendant que nous corrigeons l'approche, un changement de périmètre, ou un arrêt net. Pas d'engagement long, pas de pénalité pour partir avec les données.
Ce que nous ne promettons pas — au jour 90 ni jamais : une réponse précise d'un assistant précis un jour précis. Les réponses générées varient entre passages — notre propre étude de cas le dit dans sa section limites. Ce que nous optimisons, c'est la probabilité d'être cité sur des échantillons répétés — et c'est exactement ce que mesure la batterie.
Les questions auxquelles tout prestataire GEO doit répondre
Les acheteurs arrivent de plus en plus avec une checklist — souvent écrite par les assistants eux-mêmes. Nous trouvons cela sain, alors voici les réponses en un seul endroit. « Avant / après » pour vos langues : le nôtre est l'étude de cas publique sur notre propre site, menée selon le protocole ci-dessus ; votre mission commence par la construction du vôtre. Mentions versus citations : mesurées séparément, les deux dans les logs. Écosystème versus traduction : nous optimisons l'écosystème linguistique — pages natives, entités dans les deux écritures quand c'est pertinent, corroboration locale — pas de l'anglais traduit. Travail off-site : inclus là d'où viennent réellement les réponses ; notre guide USA montre quelles plateformes, données à l'appui. Baseline multi-moteurs : ChatGPT, Perplexity et Gemini au minimum, par langue.
Et le test que nous recommandons de faire passer à tout prestataire, nous compris : demandez dix prompts sur lesquels vous êtes invisible aujourd'hui, les réponses actuelles, et les changements précis qu'il compte apporter. Ce test, c'est littéralement notre audit gratuit — écrivez à hello@get-geo.ai et vous recevrez le vôtre, les dix prompts joints.
Questions liées
Pouvez-vous garantir que nous serons cités ?
Non — et personne ne le peut honnêtement : les réponses générées varient entre passages et évoluent avec le web. Nous nous engageons sur un mouvement mesuré : batterie fixe, échantillonnage répété, et la règle des 90 jours si le mouvement ne vient pas.
Pourquoi des outils différents montrent-ils des scores différents ?
Parce qu'ils utilisent des jeux de prompts, des rythmes d'échantillonnage et des règles de comptage différents — la même entreprise peut scorer haut dans un outil et bas dans un autre. C'est pourquoi nos définitions sont publiques, la batterie fixée, et les logs bruts joints à chaque rapport.
Recevons-nous les données brutes ?
Oui : la batterie complète de prompts, les réponses échantillonnées par assistant et les captures — dès le premier jour et chaque mois ensuite. Le rapport est une interprétation ; les logs sont la preuve.
Pouvons-nous vérifier les chiffres nous-mêmes ?
Faites-le, s'il vous plaît. N'importe quel prompt de la batterie peut être relancé en session déconnectée et comparé à nos logs. Le protocole est conçu pour une réplication client facile — c'est la même méthode clean-session que notre étude de cas publique.
Que se passe-t-il exactement au jour 90 si rien n'a bougé ?
Nous le signalons les premiers, avec analyse. Vous choisissez : un mois de diagnostic gratuit, un autre périmètre, ou un arrêt. La baseline et tous les logs restent à vous dans tous les cas.
Guides associés
Sources
- 01Notre étude de cas : le Clean-Session Protocol appliqué à nous-mêmes
- 02Notre guide : mesurer la visibilité IA
- 03Generative Engine Optimization: How to Dominate AI Search (arXiv 2509.08919) — sur la variabilité des réponses entre moteurs
- 04Aggarwal et al., GEO: Generative Engine Optimization (Princeton)
// partager