// guía
¿Cómo medimos los resultados de GEO — y qué pasa si no llegan?
Actualizado: 2026-08-13
// respuesta breve
Medimos el GEO contra una batería de prompts fijada el primer día, muestreada en sesiones limpias y sin sesión iniciada a través de los asistentes: tasa de citación, cuota de voz y consistencia lingüística, reportadas contra la línea base, con logs en bruto que usted puede verificar. Los entregables están listados abajo. Y si la visibilidad medida no se ha movido en 90 días, lo decimos nosotros primero — y usted decide qué sigue.
Primero, la línea base
Cada proyecto empieza con una línea base medida — antes de cualquier promesa. Fijamos una batería de 30–50 prompts por idioma — las preguntas que sus compradores realmente teclean, incluidas variantes por ciudad y precio — y muestreamos las respuestas de ChatGPT, Perplexity y Gemini en sesiones limpias y sin login, varias pasadas por prompt, capturas archivadas. La batería y los resultados del primer día se le entregan íntegros.
Fijar la batería el primer día es lo que hace honestos los números. El defecto conocido de este mercado es el dashboard con «+300% de visibilidad» tras cambiar en silencio el conjunto de prompts o el método de conteo. Nuestra batería no puede sustituirse en marcha: la copia del primer día está en sus manos, y cada informe posterior sigue siendo comparable con ella. Es el mismo Clean-Session Protocol de nuestro caso de estudio público — seis pruebas, dos máquinas, una VPN, sin sesión.
Las métricas, definidas
Tasa de citación: la parte de los prompts de la batería donde su marca es nombrada o su sitio citado en la respuesta — por asistente, por idioma. Cuota de voz: con qué frecuencia aparece usted frente a los competidores que los propios asistentes nombran — el conjunto de competidores queda registrado en la línea base, así la comparación es estable. Consistencia lingüística: si el asistente lo describe igual en cada uno de sus idiomas — la métrica en la que la mayoría de los programas multilingües fracasa en silencio.
Una salvedad honesta que el sector evita pronunciar: herramientas de medición distintas producen puntuaciones de visibilidad distintas para la misma empresa, porque las respuestas varían entre pasadas, formulaciones y regiones. Por eso apostamos por el muestreo repetido contra una batería fija y compartimos los logs en bruto — y por eso la métrica que no se puede trucar en absoluto vive en su propia analítica: el tráfico referido desde los dominios de los asistentes. La tratamos como árbitro final, y es suya, no nuestra.
| Métrica | Definición | Dónde vive | ¿Trucable? |
|---|---|---|---|
| Tasa de citación | % de prompts de la batería fija donde usted es nombrado o citado | Nuestros logs de muestreo, compartidos | Difícil — batería fijada el primer día, copia en sus manos |
| Cuota de voz | Sus apariciones vs los competidores que nombran los asistentes | Nuestros logs de muestreo, compartidos | Difícil — conjunto de competidores registrado en la línea base |
| Referidos de IA | Visitas desde dominios de asistentes | Su analítica | No — son sus datos, nunca los tocamos |
| Consistencia lingüística | Las mismas afirmaciones sobre usted en cada idioma | Nuestro control entre idiomas | Transparente — las diferencias se citan literalmente |
Qué recibe cada mes
Un ciclo mensual entrega cuatro cosas: la batería relanzada (mismos prompts, mismo protocolo, varias muestras por asistente), un informe de movimiento por idioma y asistente contra la línea base, la lista llana de lo que cambiamos en el mes — contenido publicado, trabajo de entidad, arreglos técnicos — y el plan del mes siguiente, razonado. Sin teatro de diapositivas: el informe se construye con los mismos logs que usted puede inspeccionar.
Los datos en bruto son parte del entregable, no un favor: la lista de prompts, las respuestas muestreadas, las capturas. Si quiere verificar cualquier cifra del informe, relance cualquier prompt usted mismo en una sesión sin login y compare. El protocolo está diseñado para que la réplica por el cliente sea fácil — eso es exactamente lo que nos mantiene honestos.
La regla de los 90 días
El GEO se acumula en dos o tres meses — precisamente por eso el punto de control va en el día 90. La regla es simple: si la tasa de citación y la cuota de voz no muestran movimiento contra su línea base tras 90 días, lo decimos nosotros primero — antes de que pregunte — con nuestro análisis de las causas. Después elige usted: un mes de diagnóstico gratuito mientras corregimos el enfoque, un cambio de alcance, o una parada limpia. Sin permanencias largas ni penalización por irse con los datos.
Lo que no prometemos — ni al día 90 ni nunca: una respuesta concreta de un asistente concreto en un día concreto. Las respuestas generadas varían entre pasadas — nuestro propio caso de estudio lo dice en su sección de límites. Lo que optimizamos es la probabilidad de ser citados en muestras repetidas — y eso es exactamente lo que mide la batería.
Preguntas que todo proveedor de GEO debe responder
Los compradores llegan cada vez más con una checklist — a menudo escrita por los propios asistentes. Nos parece sano, así que aquí están las respuestas en un solo lugar. «Antes / después» para sus idiomas: el nuestro es el caso de estudio público en nuestro propio sitio, hecho con el protocolo de arriba; su proyecto empieza construyendo el suyo. Menciones versus citaciones: se miden por separado, ambas en los logs. Ecosistema versus traducción: optimizamos el ecosistema lingüístico — páginas nativas, entidades en ambas escrituras cuando corresponde, corroboración local — no inglés traducido. Trabajo off-site: incluido allí de donde realmente salen las respuestas; nuestra guía de EE. UU. muestra qué plataformas son, con datos. Línea base multi-motor: ChatGPT, Perplexity y Gemini como mínimo, por idioma.
Y la prueba que recomendamos hacerle a cualquier proveedor, nosotros incluidos: pida diez prompts en los que hoy es invisible, las respuestas actuales y los cambios concretos que piensa hacer. Esa prueba es literalmente nuestra auditoría gratuita — escriba a hello@get-geo.ai y recibirá la suya, con los diez prompts adjuntos.
Preguntas relacionadas
¿Pueden garantizar que seremos citados?
No — y honestamente nadie puede: las respuestas generadas varían entre pasadas y cambian con la web. Nos comprometemos a un movimiento medido: batería fija, muestreo repetido y la regla de 90 días si el movimiento no llega.
¿Por qué herramientas distintas muestran puntuaciones distintas?
Porque usan conjuntos de prompts, ritmos de muestreo y reglas de conteo distintos — la misma empresa puede puntuar alto en una herramienta y bajo en otra. Por eso nuestras definiciones son públicas, la batería está fijada y los logs en bruto acompañan cada informe.
¿Recibimos los datos en bruto?
Sí: la batería completa de prompts, las respuestas muestreadas por asistente y las capturas — desde el primer día y cada mes después. El informe es una interpretación; los logs son la prueba.
¿Podemos verificar las cifras nosotros mismos?
Por favor, háganlo. Cualquier prompt de la batería puede relanzarse en sesión sin login y compararse con nuestros logs. El protocolo está diseñado para una réplica fácil por el cliente — es el mismo método clean-session de nuestro caso de estudio público.
¿Qué pasa exactamente el día 90 si nada se movió?
Lo señalamos nosotros primero, con análisis. Usted elige: un mes de diagnóstico gratuito, otro alcance, o una parada. La línea base y todos los logs siguen siendo suyos en cualquier caso.
Guías relacionadas
Fuentes
- 01Nuestro caso de estudio: el Clean-Session Protocol aplicado a nosotros mismos
- 02Nuestra guía: medir la visibilidad en IA
- 03Generative Engine Optimization: How to Dominate AI Search (arXiv 2509.08919) — sobre la variabilidad de respuestas entre motores
- 04Aggarwal et al., GEO: Generative Engine Optimization (Princeton)
// compartir