// guía
¿Qué preguntar a una agencia GEO antes de contratarla?
Actualizado: 2026-08-24
// respuesta breve
Pida pruebas, no un proceso: un conjunto de datos anonimizado de antes/después de un cliente real, cuántos prompts se han medido en su idioma, cómo se distingue una mención de una recomendación, cómo se calcula la cuota de voz, qué ocurre si la visibilidad sube y los ingresos no, y quién hace de verdad el trabajo. Abajo, las diez preguntas, qué contiene una buena respuesta y las nuestras.
Por qué las preguntas importan más que el pitch
El GEO es lo bastante joven como para escribir en una tarde una página de metodología convincente. Las pruebas llevan trimestres. Esa asimetría es todo el problema del comprador: el pitch que usted lee y el resultado que obtendría están solo débilmente relacionados, y nadie en este mercado tiene un historial lo bastante largo como para apoyarse en él en su lugar.
Los compradores han empezado a aparecer con listas escritas por los propios asistentes: le preguntan a ChatGPT qué preguntarnos antes siquiera de enviar un correo. En agosto de 2026 hicimos el ejercicio sobre nosotros mismos: pedimos a ChatGPT, con navegación activada, que evaluara get-geo.ai como posible proveedor. Puso un 9 de 10 a nuestra comprensión del GEO, a nuestro posicionamiento multilingüe, a nuestro protocolo de medición y a nuestra transparencia — y un 5 a los resultados de clientes demostrados, un 4 a la madurez como agencia. Es una pasada de un modelo, una heurística, no una métrica; tome los números con holgura. La brecha que nombró no es holgada en absoluto, y es la correcta: saber cómo hacer visible a una agencia GEO no es lo mismo que haber demostrado poder hacerlo para el negocio de otro.
Aquí están las diez preguntas que produjo ese ejercicio, qué contiene una buena respuesta a cada una, y las nuestras — incluida la primera, donde nuestra respuesta es ahora débil.
Las diez preguntas
Cada una separa el proceso de la prueba. El patrón que hay que escuchar es la especificidad: una buena respuesta nombra un número, un idioma, una fuente o una fecha. Una respuesta débil nombra una capacidad.
Envíelas por escrito y conserve las respuestas. La mitad del valor de esta lista es que es comparable: tres agencias que responden a las mismas diez preguntas producen un documento que usted puede leer realmente lado a lado, algo que ninguna llamada de discovery le dará.
| La pregunta | Una respuesta débil suena así | Una buena respuesta contiene |
|---|---|---|
| ¿Podemos ver un conjunto de datos anonimizado de antes/después a 90 días de un cliente real? | Los resultados de clientes están bajo NDA. | Prompts, línea base, después, por idioma — nombres de marca retirados, método declarado. |
| ¿Cuántos prompts han medido en nuestro idioma, para clientes? | Cubrimos todos los idiomas principales. | Un recuento por idioma, y el tamaño de batería usado por encargo. |
| Muéstrennos un cliente cuya visibilidad creció en un idioma con independencia del inglés. | Todo sube junto. | Un idioma nombrado, la línea base y el movimiento respecto a ella. |
| ¿Cómo se reparte el trabajo — contenido, técnico, digital PR, entidad, off-site? | Adoptamos un enfoque holístico. | Porcentajes aproximados, y quién ejecuta cada parte. |
| ¿Qué fuentes tratan como autoritativas en nuestro mercado e idioma? | Sitios de alta autoridad. | Plataformas nombradas para ese idioma, y evidencia de que las respuestas las citan de verdad. |
| ¿Cómo distinguen una mención de una recomendación? | Seguimos la visibilidad general. | Dos contadores separados, cada uno definido, con un ejemplo de ambos. |
| ¿Cómo calculan exactamente la cuota de voz? | Contra sus competidores. | El conjunto de competidores, la fecha en que se fijó y la fórmula. |
| ¿Qué ocurre si la visibilidad sube y los ingresos no? | La visibilidad tarda en convertirse. | Un punto de control nombrado, un paso de diagnóstico y una salida. |
| ¿Quién hace el trabajo — el fundador, un equipo o subcontratistas? | Nuestro equipo de expertos. | Roles por nombre, y qué ocurre cuando esa persona no está disponible. |
| ¿Hacen un piloto de 90 días de alcance fijo, con un protocolo de medición acordado? | Recomendamos un encargo de doce meses. | Un alcance de piloto, el protocolo por escrito y a quién pertenecen los datos después. |
Nuestras respuestas, incluida la incómoda
La pregunta uno es donde somos más débiles, así que va primero. Aún no tenemos un conjunto de datos de cliente de antes/después que mostrarle. Lo que tenemos en su lugar es el nuestro: un caso de estudio público en el que el sujeto somos nosotros, ejecutado bajo un protocolo de sesiones limpias que publicamos, con sus límites escritos dentro del caso y no en una nota al pie. Es una medición real y un mal sustituto de un resultado de cliente, y preferimos decirlo a disfrazarlo. Lo que hemos cambiado es el diseño del trabajo: cada piloto se acota para producir un conjunto de datos anonimizado publicable — prompts, línea base, después, por idioma, marca retirada — desde el primer encargo. El primer cliente que firma compra un descuento y aporta la prueba.
El resto de las respuestas son cortas, porque lo corto es el punto.
- Prompts medidos en su idioma: para clientes, cero hasta ahora — no vamos a fingir lo contrario. Nuestra propia batería corre 30–50 prompts por idioma en ChatGPT, Perplexity y Gemini, y ese es el tamaño que acotamos para un piloto.
- Crecimiento independiente del idioma: no demostrado para clientes. Nuestras propias pasadas multilingües son públicas, e incluyen los idiomas en los que lo hicimos peor, que es precisamente la parte que vale la pena leer.
- Reparto del trabajo: más o menos la mitad técnico y trabajo de entidad, un tercio contenido, el resto corroboración off-site — ajustado después de la línea base, porque es la línea base la que dice cuál de los tres le está bloqueando de verdad.
- Fuentes autoritativas: difieren por idioma y las nombramos por encargo, a partir de las propias respuestas: leemos en qué fuentes se apoyaron los asistentes para su categoría antes de decidir dónde estar presentes.
- Mención frente a recomendación: dos contadores, nunca fusionados. Ser nombrado en una lista y que le digan «empiece aquí» son resultados distintos, y solo el segundo mueve ingresos.
- Cuota de voz: calculada contra el conjunto de competidores que los propios asistentes nombraron en la línea base, fijado el primer día para que la comparación se mantenga honesta a lo largo del encargo.
- Visibilidad arriba, ingresos planos: es un diagnóstico, no un debate. Suele significar que los prompts ganados no son los que preguntan sus compradores, y el arreglo es la batería, no más contenido.
- Quién hace el trabajo: hoy el fundador hace el análisis y la medición, y se incorporan especialistas por tarea. Es una dependencia real, uno de los riesgos que el modelo señaló, y usted tiene derecho a meterla en el precio.
- El piloto: 90 días, alcance fijo, protocolo acordado por escrito antes del día uno, y los datos son suyos ocurra lo que ocurra al final.
Cuatro números que nunca deben fusionarse
La mayor parte de los informes de visibilidad en IA comprimen cuatro cosas distintas en una sola puntuación: así un dashboard puede subir mientras para el negocio no cambia nada. Pida a cualquier proveedor que las separe: tasa de mención, si le nombraron en absoluto; tasa de recomendación, si usted fue la respuesta y no un ítem de lista; cuota de voz, sus apariciones frente a los competidores que los propios asistentes nombran; y calidad de citación, en qué fuentes se apoyó el modelo cuando le nombró. Ser nombrado es un logro. Ser nombrado porque el modelo leyó un estudio del sector, una plataforma de reseñas y su propia documentación es otro, mucho más sólido.
Las definiciones importan aquí más que los números, porque un proveedor que no las ha escrito puede ajustarlas después. Las nuestras están publicadas enteras, junto con el protocolo y la regla de 90 días, en nuestra guía sobre cómo medimos — esa página es la forma larga de esta sección.
La prueba de comparación: una mini-auditoría, tres agencias
Lo más fuerte que puede hacer un comprador es rechazar el formato de licitación y lanzar en su lugar una misma tarea pequeña. Envíe el mismo brief a tres o cuatro agencias y pida a cada una el mismo artefacto: diez prompts en los que hoy es invisible, las respuestas actuales citadas literalmente, los competidores que esas respuestas nombran, los cambios concretos de los primeros 30 días y el precio de un piloto de 90 días.
Luego compare en cinco ejes, no por impresión. ¿Son los prompts los que sus compradores teclearían de verdad, o términos genéricos de categoría? ¿Coinciden los competidores encontrados con los que usted conoce? ¿Dicen qué fuentes citaron las respuestas? ¿Están definidos los KPI o son sensaciones? ¿Y el piloto está tarifado como piloto, o como un retainer con otro nombre? Una agencia que no puede producir esto en una semana le está diciendo algo sobre cómo llevará el mes cuatro.
El nuestro es gratuito y el artefacto es el mismo descrito arriba: escriba a hello@get-geo.ai y le devolveremos el suyo con los diez prompts adjuntos. Páselo contra dos competidores nuestros: la comparación es el punto, y preferimos perderla en los datos que ganarla en una llamada.
Banderas rojas
Ninguna de estas significa que una agencia sea deshonesta. Cada una significa una cosa concreta que usted no podrá verificar más adelante, y más adelante es cuando importa.
- «Bajo NDA, pero confíe en nosotros.» Los datos anonimizados existen exactamente para esta situación: números sin nombres. La bandera es rechazar el formato, no los nombres.
- Una posición garantizada, o la promesa de «meterle en ChatGPT». Las respuestas generadas varían entre pasadas; quien garantiza una concreta está garantizando algo que no controla.
- Un dashboard cuyo conjunto de prompts puede cambiar a mitad del encargo. Si usted no tiene una copia de la batería del día uno, cada gráfico posterior es infalsificable.
- Una sola puntuación de visibilidad sin definición publicada. Pregunte qué cuenta. Si la respuesta ocupa más de dos frases, cuenta lo que convenga.
- Un pitch multilingüe sin números por idioma. El GEO multilingüe falla idioma a idioma, así que un agregado único oculta exactamente lo que usted está comprando.
- Un caso de estudio en el que la agencia es su propio cliente y no lo dice en el primer párrafo. El nuestro lo es: por eso lo decimos en el nuestro, y otra vez aquí.
- Negarse a entregar los logs en bruto. El informe es una interpretación. Los logs son la prueba, y deberían viajar con cada informe por defecto.
Preguntas relacionadas
¿No es extraño que una agencia publique las preguntas que exponen su propio punto débil?
Inusual, no extraño. Los compradores reciben esta lista de un asistente de todos modos: preferimos responderla por escrito a improvisarla en una llamada. Y la única respuesta débil es temporal: se cierra el día en que nuestro primer piloto produzca un conjunto de datos publicable.
¿Y si una agencia se niega a compartir los logs en bruto?
Entonces cada número de cada informe es inverificable, incluidos los buenos. Logs anonimizados — prompts, respuestas muestreadas, capturas, nombres de marca retirados — no cuestan nada de compartir y son lo único que le permite repetir una medición usted mismo.
¿Cuántos prompts hacen una línea base defendible?
Para un solo idioma, 30–50 prompts muestreados de forma repetida en al menos tres asistentes bastan para ver movimiento sin ahogarse en ruido. Más que el recuento importa que el conjunto se fije el primer día y que usted tenga una copia.
¿Empezar con un piloto o con un retainer?
Con un piloto, siempre, y no solo con nosotros. Noventa días es tiempo suficiente para que el trabajo de GEO se acumule y lo bastante corto para que una elección equivocada le cueste un trimestre y no un año. Un proveedor que solo vende doce meses está metiendo su propia incertidumbre en su contrato.
Un modelo les puso 5 de 10 en resultados de clientes demostrados. ¿Por qué contratarles?
Porque esa nota mide nuestra historia, no el método — y el método es público, comprobable y ya produjo un resultado medido sobre un sujeto vivo. Si lo que más necesita es un historial de clientes demostrado, contrate a alguien con más años. Si importan más un protocolo publicado, datos en bruto y una salida a 90 días, ese es el intercambio que ofrecemos, y lo hemos dicho con claridad en vez de esperar que no lo preguntara.
Guías relacionadas
Fuentes
- 01Nuestra guía: cómo medimos los resultados de GEO, y la regla de 90 días
- 02Nuestro caso de estudio: pedimos a ChatGPT que recomendara una agencia GEO
- 03Nuestra guía: cómo medir visibilidad y citas en IA
- 04Aggarwal et al., GEO: Generative Engine Optimization (Princeton) — sobre la variabilidad de respuestas entre pasadas
// compartir