Todos los recursos
Monitoring y Analytics5 min de lectura

Las métricas GEO que realmente importan

Tasa de citación, sentimiento por LLM, share of voice, fuentes utilizadas: las métricas GEO que realmente importan — y las que hay que ignorar.

Las métricas GEO que realmente importan

El SEO tiene sus métricas. Posición media, tasa de clics, impresiones, tráfico orgánico. Años de práctica han sedimentado un marco de referencia común. Todo el mundo sabe qué significa un buen DA. Todo el mundo lee los mismos dashboards.

El GEO todavía no tiene ese marco de referencia. El mercado es joven. Las herramientas se están construyendo. Y en medio de esa incertidumbre, muchos dashboards de GEO miden lo que es fácil de medir — no lo que realmente importa.

Estas son las señales que merecen atención de verdad.

La tasa de citación, no la presencia bruta

La primera métrica evidente es la presencia: ¿se menciona mi marca en las respuestas de los LLM? Es el nivel cero. Útil para detectar una ausencia total, insuficiente para pilotar la estrategia.

Lo que importa es la tasa de citación ponderada: en los prompts relacionados con mi categoría, ¿en qué proporción de respuestas aparezco? Y, sobre todo, ¿esa proporción evoluciona con el tiempo?

Una tasa de citación que crece es la señal de que las acciones de contenido, activación y monitorización están dando sus frutos. Una tasa estable pese a la inversión en contenido señala una competencia más activa o un problema de legibilidad técnica que neutraliza los esfuerzos.

El sentimiento por LLM

Que te citen ya es bueno. Que te citen de forma positiva es el objetivo.

El sentimiento de marca en los LLM es una métrica que no existía hace dos años. Hoy, las herramientas GEO más avanzadas lo miden: para cada LLM, ¿cuál es el tono general de las menciones de la marca? ¿Positivo, neutro, negativo? ¿Y sobre qué atributos concretos se construye ese sentimiento?

La dimensión multi-LLM no es un detalle menor aquí. Un sentimiento positivo en Perplexity y negativo en ChatGPT es una situación habitual. Suele señalar que ambos modelos están recurriendo a fuentes distintas — una comparativa antigua visible para ChatGPT, prensa reciente y positiva accesible para Perplexity. Identificarlo es saber dónde actuar.

El share of voice por categoría de prompts

Un competidor puede tener una tasa de citación global inferior a la vuestra y aun así superaros en los prompts que más convierten.

La segmentación por categoría de prompt es esencial: prompts de comparación ("X vs Y"), prompts de intención de compra ("mejor X para Y"), prompts de descubrimiento ("qué es X"), prompts de validación ("¿es X fiable?"). En cada uno de estos ángulos, el share of voice puede ser muy distinto.

Una marca B2B puede estar bien posicionada en los prompts de descubrimiento y ausente en los de comparación — precisamente donde se deciden las compras. Es un diagnóstico preciso que orienta las prioridades de contenido.

La calidad de las fuentes utilizadas

Los LLM no citan todo el contenido que los alimentó. Citan una parte de las fuentes, a menudo las más recientes, las mejor estructuradas, o las que tienen la señal de confianza más fuerte.

Hacer seguimiento de qué fuentes utilizan los LLM cuando hablan de vuestra marca es una métrica de diagnóstico muy potente. Si se trata sistemáticamente de comparativas de terceros que no controláis, con dos años de antigüedad y que contienen información obsoleta, ya sabéis dónde hay que trabajar.

Si vuestras propias páginas empiezan a aparecer como fuente, es una señal de progreso técnico (legibilidad para la IA, llms.txt) y editorial.

La evolución en el tiempo, no la foto fija

Todas estas métricas son poco útiles como lectura puntual. El GEO es una práctica de medio plazo. Una tasa de citación que pasa del 12% al 18% en seis meses en los prompts de compra de la categoría es una señal fuerte. Una foto fija del 18% sin línea base es ruido.

Medir la tendencia exige regularidad. Semanal para las métricas de sentimiento y citación en los prompts clave. Mensual para el share of voice competitivo. Trimestral para la auditoría de fuentes utilizadas.

Vurto estructura esta monitorización de forma continua, con una granularidad por LLM, por categoría de prompt y por competidor. El dashboard da acceso a la tendencia, no solo a la cifra del momento. Algo poco habitual entre las herramientas del mercado, que suelen ofrecer vistas estáticas.

Lo que no debe figurar en un dashboard GEO

Algunas métricas que se ven a menudo y que no deberían pilotar una estrategia GEO.

El número total de menciones brutas. Sin ponderar por la calidad del contexto o la relevancia del prompt, esta cifra sirve de poco. Una marca puede ser mencionada 500 veces a la semana en contextos negativos o fuera de su público objetivo.

La posición en rankings de "mejores herramientas GEO". Algunas herramientas construyen su propia base de prompts sesgada hacia los benchmarks que las favorecen. Cuidado con los rankings autorreferenciales.

La presencia en LLM "exóticos" con una cuota de uso mínima. Monitorizar diez LLM, de los cuales ocho tienen un 0,1% de cuota de mercado, es ruido. Concentrar la atención en ChatGPT, Gemini, Perplexity y Claude cubre la parte esencial del tráfico generativo real.

La pregunta que hay que hacerse cada semana

¿Está creciendo mi visibilidad en los LLM en los prompts que corresponden a mis compradores reales?

No "¿me mencionan?", sino "¿me mencionan en las conversaciones correctas, en el sentido correcto, con las fuentes correctas?"

Es esta pregunta la que transforma la monitorización GEO en pilotaje estratégico.


Vurto monitoriza la tasa de citación, el sentimiento de marca, el share of voice competitivo y las fuentes utilizadas por LLM, de forma continua.