// guida
Come misuriamo i risultati GEO — e cosa succede se non arrivano?
Aggiornato: 2026-08-13
// risposta breve
Misuriamo il GEO contro una batteria di prompt fissata il primo giorno, campionata in sessioni pulite e disconnesse sui vari assistenti: tasso di citazione, share of voice e coerenza linguistica, riportati contro la baseline, con log grezzi che potete verificare. I risultati consegnati sono elencati sotto. E se la visibilità misurata non si è mossa dopo 90 giorni, lo diciamo noi per primi — e decidete voi come proseguire.
Prima di tutto la baseline
Ogni incarico comincia con una baseline misurata — prima di qualsiasi promessa. Fissiamo una batteria di 30–50 prompt per lingua — le domande che i vostri compratori digitano davvero, incluse le varianti per città e prezzo — e campioniamo le risposte di ChatGPT, Perplexity e Gemini in sessioni pulite e disconnesse, più passaggi per prompt, screenshot archiviati. Batteria e risultati del primo giorno vi vengono consegnati per intero.
Fissare la batteria il primo giorno è ciò che rende i numeri onesti. Il difetto noto di questo mercato è la dashboard con «+300% di visibilità» dopo un cambio silenzioso del set di prompt o del metodo di conteggio. La nostra batteria non si può sostituire in corsa: la copia del primo giorno è vostra, ogni report successivo resta confrontabile con essa. È lo stesso Clean-Session Protocol del nostro caso studio pubblico — sei run, due macchine, una VPN, senza login.
Le metriche, definite
Tasso di citazione: la quota di prompt della batteria in cui il vostro brand è nominato o il vostro sito citato nella risposta — per assistente, per lingua. Share of voice: quanto spesso apparite rispetto ai concorrenti che gli assistenti stessi nominano — il set di concorrenti è registrato alla baseline, il confronto resta stabile. Coerenza linguistica: se l'assistente vi descrive allo stesso modo in ogni vostra lingua — la metrica su cui la maggior parte dei programmi multilingue fallisce in silenzio.
Una riserva onesta che il settore evita di pronunciare: strumenti di misura diversi producono punteggi di visibilità diversi per la stessa azienda, perché le risposte variano tra run, formulazioni e regioni. Per questo puntiamo sul campionamento ripetuto contro una batteria fissa e condividiamo i log grezzi — e per questo la metrica che non si può truccare affatto vive nella vostra analytics: il traffico referral dai domini degli assistenti. La trattiamo come arbitro finale, ed è vostra, non nostra.
| Metrica | Definizione | Dove vive | Truccabile? |
|---|---|---|---|
| Tasso di citazione | % dei prompt della batteria fissa in cui siete nominati o citati | I nostri log di campionamento, condivisi | Difficile — batteria fissata il primo giorno, copia vostra |
| Share of voice | Le vostre apparizioni vs i concorrenti nominati dagli assistenti | I nostri log di campionamento, condivisi | Difficile — set di concorrenti registrato alla baseline |
| Referral IA | Visite dai domini degli assistenti | La vostra analytics | No — sono dati vostri, non li tocchiamo mai |
| Coerenza linguistica | Le stesse affermazioni su di voi in ogni lingua | Il nostro controllo inter-lingua | Trasparente — le differenze sono citate parola per parola |
Cosa ricevete ogni mese
Un ciclo mensile consegna quattro cose: la batteria rilanciata (stessi prompt, stesso protocollo, più campioni per assistente), un report di movimento per lingua e assistente contro la baseline, l'elenco semplice di ciò che abbiamo cambiato nel mese — contenuti pubblicati, lavoro sulle entità, correzioni tecniche — e il piano del mese successivo, motivato. Niente teatro di slide: il report nasce dagli stessi log che potete ispezionare.
I dati grezzi sono parte dei risultati consegnati, non un favore: la lista dei prompt, le risposte campionate, gli screenshot. Per verificare qualunque numero del report, rilanciate qualunque prompt in sessione disconnessa e confrontate. Il protocollo è progettato perché la replica da parte del cliente sia facile — è esattamente ciò che ci tiene onesti.
La regola dei 90 giorni
Il GEO si accumula in due-tre mesi — proprio per questo un checkpoint sta al giorno 90. La regola è semplice: se tasso di citazione e share of voice non mostrano movimento contro la vostra baseline dopo 90 giorni, lo diciamo noi per primi — prima che lo chiediate — con la nostra analisi dei motivi. Poi scegliete voi: un mese di diagnosi gratuito mentre correggiamo l'approccio, un cambio di perimetro, o uno stop netto. Nessun vincolo lungo, nessuna penale per andarsene con i dati.
Ciò che non promettiamo — al giorno 90 né mai: una risposta specifica di un assistente specifico in un giorno specifico. Le risposte generate variano tra i run — il nostro stesso caso studio lo dice nella sezione limiti. Ciò che ottimizziamo è la probabilità di essere citati su campioni ripetuti — ed è esattamente ciò che la batteria misura.
Le domande a cui ogni fornitore GEO deve rispondere
I compratori arrivano sempre più spesso con una checklist — spesso scritta dagli assistenti stessi. Lo troviamo sano, quindi ecco le risposte in un unico posto. «Prima / dopo» per le vostre lingue: il nostro è il caso studio pubblico sul nostro stesso sito, condotto col protocollo sopra; il vostro incarico comincia costruendo il vostro. Menzioni versus citazioni: misurate separatamente, entrambe nei log. Ecosistema versus traduzione: ottimizziamo l'ecosistema linguistico — pagine native, entità in entrambe le scritture dove serve, corroborazione locale — non inglese tradotto. Lavoro off-site: incluso là da dove le risposte arrivano davvero; la nostra guida USA mostra quali piattaforme, dati alla mano. Baseline multi-motore: ChatGPT, Perplexity e Gemini come minimo, per lingua.
E il test che consigliamo di far fare a qualunque fornitore, noi compresi: chiedete dieci prompt su cui oggi siete invisibili, le risposte attuali e le modifiche precise che intende apportare. Quel test è letteralmente il nostro audit gratuito — scrivete a hello@get-geo.ai e riceverete il vostro, con i dieci prompt allegati.
Domande correlate
Potete garantire che saremo citati?
No — e onestamente non può nessuno: le risposte generate variano tra i run e cambiano col web. Ci impegniamo su un movimento misurato: batteria fissa, campionamento ripetuto e la regola dei 90 giorni se il movimento non arriva.
Perché strumenti diversi mostrano punteggi di visibilità diversi?
Perché usano set di prompt, ritmi di campionamento e regole di conteggio diversi — la stessa azienda può risultare alta in uno strumento e bassa in un altro. Per questo le nostre definizioni sono pubbliche, la batteria è fissa e i log grezzi viaggiano con ogni report.
Riceviamo i dati grezzi?
Sì: la batteria completa di prompt, le risposte campionate per assistente e gli screenshot — dal primo giorno e ogni mese successivo. Il report è un'interpretazione; i log sono la prova.
Possiamo verificare i numeri da soli?
Fatelo, per favore. Qualunque prompt della batteria può essere rilanciato in sessione disconnessa e confrontato con i nostri log. Il protocollo è progettato per una replica facile da parte del cliente — è lo stesso metodo clean-session del nostro caso studio pubblico.
Cosa succede esattamente al giorno 90 se nulla si è mosso?
Lo segnaliamo noi per primi, con analisi. Scegliete voi: un mese di diagnosi gratuito, un perimetro diverso, o uno stop. Baseline e log restano vostri in ogni caso.
Guide correlate
Fonti
- 01Il nostro caso studio: il Clean-Session Protocol applicato a noi stessi
- 02La nostra guida: misurare la visibilità IA
- 03Generative Engine Optimization: How to Dominate AI Search (arXiv 2509.08919) — sulla variabilità delle risposte tra motori
- 04Aggarwal et al., GEO: Generative Engine Optimization (Princeton)
// condividi