lobodrocks
METODOLOGÍA DE LA AUDITORÍA

Cómo medimos el share of voice en respuestas de IA

El AI Visibility Audit lanza 30 preguntas del recorrido de compra a ChatGPT, Gemini, Perplexity y Google AI Overviews/AI Mode, cinco veces cada una en sesiones limpias localizadas en España, y calcula tasa de mención, tasa de cita y share of voice ponderado por posición frente a cinco competidores con nombre, cada dato con su intervalo de confianza del 95%. Es una línea base medida, entregada en cinco días como informe, dataset y plan de diez pasos. Nadie controla las posiciones dentro de una respuesta de IA, así que nos comprometemos con lo que sí depende de nosotros: la medición, el plan y la siguiente medición.

Por Dmytro LobodActualizado

Una medición que no se puede comprobar es una opinión con gráfico. Esta página es el método que hay detrás del AI Visibility Audit: qué preguntamos, dónde, cuántas veces, qué registramos, cómo se calculan los números y cómo de ancho es el margen de error.

Replace with: "Todas las cifras de terceros de esta página llevan su nombre y su fecha. La aritmética se ve entera más abajo, en un ejemplo resuelto."

Qué mide la auditoría

Una sola pregunta: cuando un comprador en España le pregunta algo de tu categoría a un asistente de IA, ¿cuántas veces sale tu marca, en qué posición y quién más está? La responden cuatro números, por motor y por grupo de preguntas, con su intervalo de confianza del 95%:

  • Tasa de mención: porcentaje de ejecuciones en las que se nombra tu marca.
  • Tasa de cita: porcentaje de ejecuciones en las que se cita una URL de tu dominio.
  • Share of voice ponderado por posición: tu parte de las respuestas frente a cinco competidores con nombre, con más peso para las primeras posiciones.
  • Concentración de fuentes: en qué páginas de terceros se apoyan los motores en tu categoría y lo concentrada que está esa lista.

Todo lo demás existe para explicar esos números y moverlos.

El conjunto de preguntas: 30 preguntas, cuatro grupos

La unidad de medida es una pregunta que un comprador escribiría o diría de verdad. Construimos 30 contigo en 45 minutos y luego congelamos el conjunto. Siguen el recorrido de compra:

Grupo Qué cubre Forma típica
Categoría 10 "¿Quién hace esto?", sin nombrar marcas mejor [servicio] en Barcelona
Problema 10 El problema, antes de conocer la categoría cuánto cuesta [servicio]
Comparación 6 Alternativas y "versus" [marca A] vs [marca B]
Marca 4 Preguntas que te nombran [marca] opiniones

El reparto se adapta a cada cliente, pero los cuatro grupos están siempre, porque se comportan de forma distinta. El estudio de citas fantasma de Semrush y Growth Memo de junio de 2026 encontró que las preguntas comparativas producen menciones de marca en el 43,3% de las apariciones, frente al 18% de las informativas. Si solo mides categoría te infravaloras; si solo mides marca te haces trampas.

Cómo se construyen las 30:

  1. Partimos de las cinco cosas que un comprador pregunta sobre cualquier categoría, según el estudio de Semrush de julio de 2026: definición, comparación, alternativas, caso de uso y consideración de compra.
  2. Tú traes lo que ya dicen tus compradores: llamadas comerciales, soporte, Search Console, objeciones.
  3. Son cortas y conversacionales. El estudio de citas fantasma de Semrush de junio de 2026 encontró que los prompts cortos y conversacionales producen entre 30 y 50 veces más menciones de marca que los largos y estructurados.
  4. Van en el idioma de tus compradores: español para casi todos los clientes en España, inglés si vendes fuera.
  5. Solo el grupo de marca te nombra; los competidores aparecen únicamente en las comparaciones.
  6. Tú apruebas el conjunto y no cambia dentro del proyecto. En el AI Visibility Program cualquier cambio queda en un registro.

Cuatro motores, cinco ejecuciones, España

Los motores. ChatGPT con la búsqueda activada, Gemini, Perplexity y Google AI Overviews junto con AI Mode. La elección sigue a los usuarios españoles: el estudio de SE Ranking de junio de 2026 sobre 101.574 webs españolas sitúa a ChatGPT en el 70% del tráfico de referencia desde IA, Gemini en el 12%, Perplexity en el 12%, Copilot en el 3% y Claude en el 2%. Las funciones de IA de Google van encima del buscador que casi toda España sigue usando, y AI Mode está activo en España desde octubre de 2025. Claude se añade si lo pides.

Cinco ejecuciones por pregunta. La misma pregunta produce respuestas distintas cada vez. El método de Kevin Indig, publicado en Search Engine Land en junio de 2026, encontró que tras tres ejecuciones en ChatGPT solo persistía el 2,2% de las citas; él llama astrología a los informes de una sola ejecución. Cinco por pregunta y motor es el mínimo que convierte un dato aislado en una tasa: 150 ejecuciones por motor, 600 por auditoría.

Sesiones limpias. Cada ejecución empieza de cero: sin login, sin memoria, sin conversación previa, sin instrucciones personalizadas.

Localización en España. Las ejecuciones se hacen desde una ubicación española, con el idioma en español y Google en google.es. Los motores localizan sus fuentes: en el análisis de Ahrefs de julio de 2026 sobre 2,26 millones de prompts en español, El País era el quinto dominio más citado en ChatGPT y encabezaba las citas de AI Mode en España. La versión del modelo y la fecha quedan registradas en cada ejecución, y el informe indica si cada motor se consultó por API o por la app.

Cinco competidores, elegidos por regla

El share of voice necesita un denominador, y un denominador elegido para quedar bien no vale nada. La regla:

  1. Tú nombras las marcas contra las que pierdes ventas. Suelen ser más de cinco.
  2. Hacemos una pasada piloto con diez preguntas de categoría y anotamos las marcas que nombran los motores.
  3. Los cinco finales salen del cruce. Al menos dos deben haber aparecido en el piloto; si no, el benchmark mide tu lista de deseos, no el mercado.
  4. El conjunto queda fijo y escrito en el informe. Cualquier cambio se registra con su motivo.

Qué registramos en cada ejecución

Cada una de las 600 ejecuciones es una fila del dataset que recibes: el texto completo de la respuesta, para poder volver a puntuarlo más adelante; motor, versión del modelo, fecha, pregunta y grupo; las marcas mencionadas, en orden; las marcas citadas, con URL; tu mención y tu posición; la URL de tu cita; el sentimiento hacia tu marca (recomendada, neutral, desaconsejada); un indicador de cita fantasma; y los dominios citados.

Las métricas, con fórmulas

Tasa de mención = ejecuciones en las que se nombra tu marca ÷ todas las ejecuciones, por motor.

Tasa de cita = ejecuciones en las que se cita una URL de tu dominio ÷ todas las ejecuciones, por motor.

Share of voice ponderado por posición. En cada ejecución, cada una de las seis marcas (tú y cinco competidores) recibe puntos según su posición en la respuesta:

Posición en la respuesta Peso
Primera marca nombrada 1,0
Segunda 0,6
Tercera 0,4
Cuarta o posterior 0,2
No nombrada 0

Share of voice = tus puntos en todas las ejecuciones ÷ los puntos de las seis marcas. La posición importa: el estudio de Semrush de julio de 2026 encontró que el 74% de los usuarios elige la marca más mencionada.

Concentración de fuentes = citas a los diez dominios más citados ÷ todas las citas, por motor. Junto al porcentaje listamos esos dominios y las páginas que generan las menciones de tus competidores. Esa lista es el plan de outreach, y la parte del informe sobre la que una agencia de PR puede actuar directamente.

Un ejemplo resuelto

Un motor, 30 preguntas, 5 ejecuciones: 150 ejecuciones.

  • Tu marca se nombra en 48 ejecuciones: tasa de mención 48 ÷ 150 = 32%.
  • Se cita una URL de tu dominio en 21 ejecuciones: tasa de cita 21 ÷ 150 = 14%. En 9 de esas 21 no se nombraba la marca: tasa de citas fantasma 9 ÷ 21 = 43%.
  • Posiciones de tus 48 menciones: 10 primeras, 14 segundas, 12 terceras, 12 posteriores. Puntos: 10 × 1,0 + 14 × 0,6 + 12 × 0,4 + 12 × 0,2 = 25,6.
  • El competidor A solo se nombra en 40 ejecuciones, pero en 30 de ellas va primero: 30 × 1,0 + 6 × 0,6 + 4 × 0,4 = 35,2 puntos.
  • Las seis marcas suman 118,0 puntos. Share of voice: tú 25,6 ÷ 118,0 = 21,7%; competidor A 35,2 ÷ 118,0 = 29,8%.
  • El motor citó 1.950 URL en las 150 ejecuciones; los diez dominios más citados acumulan 897: concentración de fuentes del 46%.

Te nombran más veces que al competidor A y aun así tienes menos share of voice, porque A encabeza las respuestas. Un recuento de menciones esconde eso.

El intervalo de confianza del 95%, y por qué una sola ejecución es astrología

Cada tasa es una muestra. Para mención y cita usamos el intervalo estándar de una proporción: tasa ± 1,96 × √(tasa × (1 − tasa) ÷ ejecuciones).

En el ejemplo, la tasa de mención del 32% sobre 150 ejecuciones lleva ±7,5 puntos, así que lo honesto es decir "entre un 25% y un 40%, más o menos". La tasa de cita del 14% lleva ±5,6 puntos: "entre el 8% y el 20%". Para el share of voice, un cociente de sumas ponderadas, remuestreamos las ejecuciones (un bootstrap) y damos los percentiles 2,5 y 97,5.

De ahí salen tres reglas:

  1. Por motor, nunca mezclado. El análisis de Indig de junio de 2026 muestra que promediar motores y niveles de razonamiento crea artefactos de hasta 18 puntos.
  2. Tres puntos no son noticia. Con un intervalo de ±7, pasar del 32% al 35% es ruido, y el informe lo dice así.
  3. El intervalo es un suelo. La fórmula trata las ejecuciones como independientes, y cinco ejecuciones de una pregunta no son cinco preguntas.

Una sola ejecución no tiene intervalo. Presentada como puntuación, es astrología con logotipo.

La tasa de citas fantasma

Que te citen y que te nombren son hechos distintos, y cada motor los reparte a su manera. El estudio de Semrush y Growth Memo de junio de 2026 sobre 3.981 apariciones de marca en cuatro motores y 14 países encontró que el 61,7% de las citas de la IA eran citas fantasma: URL listada, marca sin nombrar. ChatGPT citaba la URL de las marcas en el 87% de las apariciones pero las nombraba en el 20,7%; Gemini hacía lo contrario: nombraba el 83,7% de las veces y citaba el 21,4%.

Por eso damos las dos tasas y, entre ellas, la de citas fantasma. Una tasa fantasma alta suele significar páginas informativas que los motores citan pero que nunca dicen quién eres; el arreglo son páginas comparativas y con precio, que ganan menciones.

La revisión técnica

Es corta, porque lo que más mueve los números es el contenido y la cobertura de terceros, no el marcado: el análisis de Muck Rack de mayo de 2026 sobre 25 millones de enlaces encontró que el 84% de las citas de la IA apuntan a earned media, y el contenido pagado se quedó en el 0,3%. Revisamos lo que puede bloquearte y lo que ayuda a los motores a saber quién eres:

  • Rastreabilidad. El robots.txt permite OAI-SearchBot, PerplexityBot, Google-Extended y los rastreadores de Claude; el contenido no depende solo de JavaScript; Bing Webmaster Tools e IndexNow están configurados, porque Bing alimenta a Copilot y a parte de ChatGPT.
  • Schema. Los tipos adecuados (Organization o ProfessionalService, Person, Service, FAQPage) y un sameAs que apunte a los perfiles de la propia marca. La guía de Google, actualizada en julio de 2026, dice que no hace falta ningún marcado para las funciones de IA; el schema es higiene de entidad, no una palanca de ranking.
  • Entidad. Un nombre, una descripción, un entity home, corroborados por LinkedIn, el Perfil de Empresa de Google, Wikidata y los directorios que citan los motores.
  • llms.txt. Comprobamos que existe y que es exacto, y decimos sin rodeos que los motores lo ignoran: la guía de Google de julio de 2026 afirma que Search ignora llms.txt, y el estudio de SE Ranking de noviembre de 2025 sobre unos 300.000 dominios no encontró relación entre tenerlo y ser citado. Consérvalo para agentes y personas; no esperes citas por él. (Nosotros tenemos uno, por las mismas razones.)
  • Una URL por pregunta de compra. El estudio de Surfer de diciembre de 2025 encontró que las páginas que posicionan para las subconsultas fan-out de un motor tienen un 161% más de probabilidad de ser citadas. Una sola página no posiciona para treinta preguntas.

Cada punto es un "superado" o un arreglo escrito. No damos una "puntuación sobre 100": esconde qué te bloquea.

El plan de diez pasos y la entrega

Diez pasos porque es lo que un equipo puede asumir en un trimestre. El orden es siempre el mismo; los detalles salen de tus datos: entidad; rastreadores y Bing/IndexNow; schema; una página por pregunta de compra, empezando por las que nadie responde; una comparativa justa con los competidores; una página de datos propios que la prensa del sector pueda citar; bloques de FAQ y fechas visibles; la lista de outreach que sale de la concentración de fuentes; reseñas y perfiles en los directorios que citan los motores; y una cadencia de medición que diga qué es un cambio real dado el intervalo.

La entrega: el informe por motor y grupo con intervalos, el dataset de 600 filas en CSV, las preguntas y la regla de competidores, la revisión técnica, la lista de fuentes citadas, los diez pasos con responsable y esfuerzo, y una llamada de 45 minutos para presentar los resultados.

A qué nos comprometemos

  • Números que puedes comprobar tú. Cada tasa va por motor y con su intervalo de confianza del 95%, y el dataset de 600 ejecuciones va con el informe, así que cualquier cifra se puede recalcular desde las respuestas en bruto.
  • Movimiento, no una posición garantizada. Google AI Mode sustituye cada semana el 56% de las fuentes que cita y solo el 2,2% de las citas de ChatGPT sobrevive a tres ejecuciones (Indig, junio de 2026). Quien te promete una posición fija en ChatGPT te vende algo que no controla nadie. Nosotros nos comprometemos con la línea base, el plan y la medición posterior que enseña si ha funcionado.
  • Una línea base pensada para convertirse en tendencia. Una auditoría es un punto en el tiempo. Las oleadas mensuales con el mismo conjunto de preguntas la convierten en tendencia, y para eso está el AI Visibility Program.
  • Listas cortas y calidad del lead. Las referencias desde IA fueron el 0,30% del tráfico a webs españolas entre enero y abril de 2026 (SE Ranking). El valor está en entrar en la lista corta cuando un comprador pregunta, no en las sesiones.
  • Las dos mitades de la foto. Con un 61,7% de citas fantasma, que te citen y que te recomienden son cosas distintas, así que el informe da tasa de mención, tasa de cita y, entre las dos, la de citas fantasma.

Plazo y precio

Cinco días laborables desde que apruebas las preguntas. Día 0: el brief de 45 minutos del que salen las preguntas y los competidores. Días 1 y 2: las 600 ejecuciones. Día 3: puntuación, intervalos y revisión técnica. Día 4: el plan. Día 5: la lectura.

Precio: cerrado, presupuestado en 24 horas, factura UE, sin IVA. El dataset y el informe son tuyos. Las agencias pueden trabajar la auditoría por recomendación, en co-branded o en white-label: mira cómo trabajamos con partners, o los paquetes para el resto de lo que hace el estudio. Los términos de esta página están en el glosario de visibilidad en IA.

Preguntas

¿Por qué 30 preguntas y no 300?

Treinta preguntas, cinco ejecuciones y cuatro motores ya producen 600 respuestas, suficientes para poner un intervalo de confianza útil a cada tasa por motor. Más preguntas amplían la cobertura, no la precisión; más ejecuciones por pregunta estrechan el intervalo. Si tu categoría es muy amplia, la dividimos en dos conjuntos de 30 en vez de diluir uno. El AI Visibility Program puede añadir preguntas más adelante, con el cambio anotado en el registro.

¿Por qué cinco ejecuciones por pregunta en sesiones limpias?

Porque la misma pregunta recibe respuestas distintas en ejecuciones distintas. El método de seguimiento de prompts que Kevin Indig publicó en junio de 2026 encontró que, tras tres ejecuciones en ChatGPT, solo persistía el 2,2% de las citas, y llama astrología a los informes de una sola ejecución. Cinco ejecuciones por pregunta y motor es el mínimo para que una tasa sea una tasa y no una anécdota. Sesión limpia significa sin login, sin memoria y sin ninguna conversación previa que pueda condicionar la respuesta.

¿Qué motores usáis y por qué no Claude ni Copilot?

ChatGPT con búsqueda, Gemini, Perplexity y Google AI Overviews/AI Mode, todos localizados en España. Los datos de SE Ranking de junio de 2026 sitúan a ChatGPT en el 70% del tráfico de referencia desde IA a webs españolas, Gemini y Perplexity en el 12% cada uno, Copilot en el 3% y Claude en el 2%, y las funciones de IA de Google van encima del buscador que casi toda España sigue usando. Claude se puede añadir si lo pides; no va por defecto precisamente por ese 2%.

¿Podéis garantizar que mi marca salga en ChatGPT?

No, y desconfía de quien lo haga. Google AI Mode sustituye cada semana el 56% de las fuentes que cita y solo el 2,2% de las citas de ChatGPT sobrevive a tres ejecuciones, así que prometer una posición fija es prometer algo sobre un blanco móvil. Lo que vendemos es una línea base medida, un plan construido sobre lo que los motores citan de verdad en tu categoría y, si sigues con el AI Visibility Program, una medición mensual con margen de error.

¿Qué recibo exactamente a los cinco días?

Un informe con las cuatro métricas por motor y por grupo de preguntas, cada una con su intervalo de confianza; el dataset completo de 600 ejecuciones en CSV, con el texto de la respuesta, las marcas, las URL y los indicadores de cada fila; el conjunto de preguntas aprobado y la regla de selección de competidores; la revisión técnica con sus puntos superados y sus arreglos; la lista de fuentes citadas que generan las menciones de tus competidores; el plan de diez pasos; y una llamada de lectura de 45 minutos. Las versiones de los modelos y las fechas de ejecución van en la portada.

¿Cuánto cuesta y puede revenderla una agencia?

Es un precio cerrado, presupuestado en 24 horas en cuanto sabemos tu categoría y tus mercados; sin tarifas por horas. Las agencias pueden trabajarla por recomendación, en co-branded o en white-label, y la primera reunión con una agencia de PR, branding, eventos, medios o SEO incluye una auditoría gratuita para uno de sus clientes. Los detalles están en la página de partners.

Fuentes

  1. Kevin Indig, Search Engine Land, How to make prompt tracking much more accurate 2026-065 ejecuciones por prompt; 2,2% de citas persistentes tras tres ejecuciones en ChatGPT; AI Mode sustituye el 56% de las fuentes cada semana; ejecuciones únicas como astrología; artefactos de 18 puntos al mezclar motores
  2. Semrush y Growth Memo, estudio de citas fantasma 2026-063.981 apariciones, 115 prompts, 14 países, 4 motores; 61,7% de citas fantasma
  3. Semrush y Growth Memo, estudio de autoridad temática en ChatGPT 2026-071.094 categorías de EE. UU., 50.000 marcas; las cinco preguntas del comprador; el 74% elige la marca más mencionada
  4. Muck Rack, What Is AI Reading? (tercera edición) 2026-05Más de 25 millones de enlaces en ChatGPT, Claude y Gemini
  5. SE Ranking, Tráfico de IA en España 2026-06101.574 webs con analítica de SE Ranking; reparto del tráfico de referencia por motor; la IA supone el 0,30% del tráfico
  6. Ahrefs ES, Cuáles son los medios más citados por la IA en España 2026-072,26 millones de prompts en español, seis motores
  7. Google Search Central, Optimizing your website for generative AI features on Google Search 2026-07Publicada en mayo de 2026, actualizada en julio de 2026; afirma que Google Search ignora llms.txt y que no hace falta marcado nuevo
  8. Estudio de SE Ranking sobre llms.txt, vía Search Engine Journal 2025-11Unos 300.000 dominios; 10,13% de adopción; sin relación con la frecuencia de cita
  9. Estudio de Surfer sobre fan-out, vía Search Engine Land 2025-1210.000 keywords; las páginas que posicionan para consultas fan-out tienen un 161% más de probabilidad de ser citadas
  10. Human Level, AI Mode arrives in Spain 2025-10

Comprobado en la fecha indicada; las cifras cambian.

Habla con Lobod

Empieza por las cifras. Después construimos.

Cuéntame qué lanzas, o qué no funciona. En 24 horas tienes o el paquete que encaja, con precio, o una propuesta de Research Sprint de cinco días.

Dima@lobods.comLinkedIn

Barcelona · España y UE · ES / EN · respondo el mismo día
Cartas

Dos veces al mes, algo que merece leerse sobre visibilidad en IA, lanzamientos y lo que de verdad mueve una marca.

Doble confirmación: un correo te pide confirmar y no llega nada hasta que lo haces. Un clic al final de cualquier envío y se acaba para siempre.