Puedes medir la visibilidad de tu marca en las respuestas de IA en unas tres horas, con una hoja de cálculo y sin suscripción. Lanza un conjunto fijo de 20 prompts, anota cuatro cosas por prompt, y repite cada mes sobre el conjunto idéntico. Ese es el método entero, y produce un número que puedes defender en una reunión, que es más de lo que consiguen varios paneles de pago.
La razón de hacerlo a mano al menos una vez no tiene ningún glamour. Hasta que no hayas lanzado los prompts tú, no tienes ni idea de qué está contando la puntuación de una herramienta, y asentirás ante una gráfica que no significa nada.
Un aviso honesto sobre el primer número que obtengas. Estará mal, y la última sección explica por qué no pasa nada.

¿Qué es una auditoría de visibilidad en IA?
Una auditoría de visibilidad en IA mide cuántas veces un asistente nombra, recomienda o cita tu marca cuando alguien hace una pregunta de compra en tu categoría. Eliges los prompts que escribiría un comprador real, los lanzas en condiciones controladas y registras el resultado como dato y no como impresión.
Lo de controladas carga con todo el peso. Los asistentes personalizan, leen tu historial de conversación y cambian de opinión entre ejecuciones. Una auditoría que ignore esas tres cosas está midiendo tu propia cuenta en lugar de tu mercado, y te va a halagar, porque tu cuenta lleva un año leyendo sobre tu empresa.
¿Por qué molestarse si ya existen herramientas?
Porque una puntuación que no puedes reproducir no es una prueba, y porque este sector tiene un problema de honestidad que conviene entender antes de gastar nada.
Alguien publicó esto en r/DigitalMarketing poco antes de que empezáramos a escribir: "Nuestros informes de visibilidad en IA parecen inventados. ¿Solo me pasa a mí?". No, no solo a él. Ivan Palii, que desarrolla software de SEO y por tanto no tiene motivo para halagar a la categoría, probó siete herramientas punteras de visibilidad en IA por esas mismas fechas y contó que ninguna mostraba una curva de visibilidad al nivel de un prompt individual. Si una herramienta no sabe decirte qué prompt se movió, su cifra principal es un anillo del humor.
Debajo de ese problema hay otro más hondo. Una revisión crítica de la optimización para motores generativos publicada en arXiv en julio de 2026 repasó 45 estudios y concluyó que ninguna técnica evaluada mejora de forma consistente la descubribilidad, el tráfico posterior ni los resultados de negocio en las distintas plataformas. El único experimento controlado que tiene el campo, el paper de GEO de Princeton aceptado en KDD 2024, encontró que la optimización podía "aumentar la visibilidad hasta un 40 % en las respuestas de motores generativos", con una eficacia que varía según el dominio.
Lee los dos juntos y el orden sensato es medir primero y comprar después. Que es más o menos al revés de como llega la mayoría de los equipos. Comprar panel. Entrar en pánico con el número. Preguntar qué significa el número. Hemos visto esta secuencia más de una vez y desde fuera nunca pierde la gracia.
Para llevarte: no haces esto a mano porque lo manual sea virtuoso. Lo haces una vez para poder juzgar si el número de una herramienta vale 90 € al mes, que es una decisión imposible de tomar desde fuera.
Cómo hacer la auditoría: seis pasos
Paso 1. Escribe 20 prompts repartidos en cuatro intenciones
Veinte bastan para ver un patrón y son pocos como para que llegues al final. Repártelos en cuatro grupos:
- Prompts de categoría, donde no apareces: "mejor software de gestión de proyectos para agencias"
- Prompts de comparación, que nombran a dos rivales pero no a ti: "Asana vs Monday para un equipo de 12 personas"
- Prompts de recomendación con una restricción: "CRM más barato con secuencias de email por menos de 50 € al mes"
- Prompts de objeción, los incómodos: "¿merece la pena [tu categoría] para un fundador en solitario?"
Deja el nombre de tu marca fuera de absolutamente todos los prompts. Preguntar "¿qué tal es Aiter?" te dice cómo resume un asistente nuestra propia web, que es una pregunta distinta y bastante menos útil que si alguna vez nos sacaría por su cuenta.
Una excepción, y vale el minuto extra. Lanza "¿qué es [tu marca]?" una vez por asistente como comprobación aparte, no dentro del conjunto puntuado. Ahí no mides visibilidad, cazas alucinaciones en los datos de tu entidad. Fundador equivocado, precios equivocados, país equivocado, una función que mataste hace dos años. Nosotros encontramos así una descripción caducada de nosotros mismos que llevaba meses desinformando a la gente en silencio.
El generador de abajo te redacta el conjunto entero.
Construye tu conjunto de 20 prompts
Todo corre en tu navegador. No se guarda ni se envía nada.
Categoría
Tu marca no aparece. El juego más difícil de ganar y también el más valioso.
mejor tu categoría para equipos pequeñosmejores herramientas de tu categoría en 2026cuál es el mejor software de tu categoríaqué tu categoría recomiendan los expertosherramientas de tu categoría que de verdad valen lo que cuestan
Comparación
A los rivales se les nombra y a ti no. Comprueba si el modelo llega a ti por su cuenta.
Competidor A o Competidor B, cuál es mejoralternativas a Competidor Amerece la pena Competidor A frente a Competidor BCompetidor B o Competidor A para un equipo de cincocambiar de Competidor A a algo más barato
Recomendación
Peticiones con condiciones. Estas convierten, porque quien pregunta ya decidió comprar.
tu categoría más barato que funcione de verdadtu categoría para un equipo de cinco por menos de 100 $ al mestu categoría más fácil de montar en un díamejor tu categoría cuando no tienes presupuestotu categoría que no necesite un desarrollador
Objeción
Las incómodas. Casi nadie las hace, y las respuestas dicen mucho.
merece la pena tu categoría para un fundador en solitarionecesito tu categoría de verdadpor qué tu categoría es tan caroproblemas habituales con las herramientas de tu categoríapuedo hacer tu categoría a mano
Lanza cada uno con la sesión cerrada, en una ventana privada, y anota si te nombraron, te recomendaron o te citaron como fuente. Tres columnas, no una.
Paso 2. Lanza cada prompt sin sesión iniciada, en una ventana nueva
Cierra sesión. Usa una ventana privada. No dejes que el asistente vea tu historial, porque la personalización te entregará en silencio un resultado halagador y te lo vas a creer.
Pasa los mismos 20 prompts por cada asistente que te importe. La mayoría de los equipos eligen tres: ChatGPT, Google AI Mode y Perplexity. Añade Claude si vendes a desarrolladores. Añade Copilot si vendes a empresas grandes donde IT eligió Microsoft para todo el mundo.
No añadas los seis. Cada asistente extra multiplica el trabajo por veinte prompts y mete ruido en tu media sin cambiar ni una sola de las decisiones que vas a tomar.
Paso 3. Anota cuatro columnas separadas, no una puntuación
Las herramientas comprimen esto en un solo número, y el detalle que aplastan es justo el que te dice qué arreglar la semana que viene.
| Columna | Qué significa | Por qué merece columna propia |
|---|---|---|
| Nombrada | Tu marca aparece en algún punto de la respuesta | La más barata de ganar, la señal más débil |
| Recomendada | Te presentan como una opción sugerida | La que sigue de cerca al pipeline |
| Citada | Tu dominio aparece como fuente enlazada | La que trae tráfico de verdad |
| Quién más apareció | Todas las demás marcas de la respuesta | La columna más útil de la hoja |
Las tres primeras separan tres enfermedades genuinamente distintas. Una marca puede ser citada constantemente y recomendada nunca, que es un problema de contenido. O recomendada sin ser citada jamás, lo que significa que el modelo te conoce pero no te manda a nadie. Un solo número esconde las dos.
La cuarta es la que casi todo el mundo se salta, y es la que paga. Un SEO en r/SEO lo dijo mejor de lo que lo diríamos nosotros: esa última columna te dice por qué eligen a los competidores, y la respuesta suele ser páginas de comparación, directorios e hilos de foro antes que cualquier cosa de la web del competidor. No solo te estás midiendo a ti. Estás consiguiendo gratis un mapa de qué páginas de terceros se cree el modelo en tu categoría, y meterse en esas páginas casi siempre es más fácil que superarlas en el ranking.
Paso 4. Puntúa la cuota de voz frente a tres rivales con nombre
Para cada prompt, anota qué competidores aparecieron. Después calcula la cuota de voz: tus menciones divididas entre todas las menciones de marca del conjunto.
Elige tres rivales y mantén esa lista quieta. Cambiar el conjunto de comparación de un mes a otro es la forma más fácil del mundo de fingir progreso, y si le estás reportando a alguien, acabará dándose cuenta.
Paso 5. Registra los metadatos aburridos
Fecha, asistente, versión del modelo si está a la vista, país, y si estabas sin sesión iniciada.
Sáltatelo y la comparación del mes que viene no vale nada, porque no sabrás si se movió el número o se movieron las condiciones. Nos lo hemos saltado. No valió nada.
Paso 6. Repite cada mes con el conjunto idéntico
Mismos prompts, mismo orden, mismas condiciones. Cambia el conjunto y has empezado un experimento nuevo en lugar de continuar el anterior.
Mensual es la cadencia correcta para casi todo el mundo. Semanal mide sobre todo ruido, y trimestral va tan lento que habrás olvidado qué cambio de contenido estabas probando.
¿Qué herramientas gratuitas conviene usar junto a la auditoría manual?
Cuatro, todas gratis, y entre ellas cubren la mitad del cuadro a la que tu conjunto de prompts no llega.
- El informe de IA generativa de Search Console. Impresiones de AI Overviews y del modo IA, directas de Google. Sin clics y sin consultas, así que lee qué muestra y qué esconde antes de montar un informe encima.
- Bing Webmaster Tools. Verifica el sitio aunque Bing no te mande nada. Su panel de rendimiento de IA informa de las consultas de grounding, las frases que el asistente se escribe a sí mismo cuando sale a buscar fuentes. Es el único dato gratuito a nivel de consulta que publica alguien.
- GA4, segmentado por referente. Tráfico que llega de chatgpt.com, perplexity.ai y compañía. Hoy son cifras pequeñas para casi todas las webs, pero es la única columna de esta lista que conecta con los ingresos.
- Tus logs de servidor o el panel de tu CDN. Qué rastreadores de IA piden qué, y si algo los está bloqueando.
Ese cuarto punto merece una advertencia, porque es donde buena parte del consejo sobre GEO se emociona de más. El acceso de los rastreadores es real y merece una comprobación única. Pero rara vez es lo que está roto. Un SEO que ha auditado unas 17.000 webs de pequeñas empresas este año lo resumió en r/SEO: el acceso casi nunca es el cuello de botella, robots.txt suele estar bien, GPTBot no suele estar bloqueado. Lo que mata a esas webs es que no hay nada en la página que se pueda levantar como respuesta.
Para llevarte: comprueba el acceso de los rastreadores una vez, arréglalo si está roto, y deja de mirarlo. Trata los logs de bots como tu capa de depuración y la auditoría de prompts como tu KPI de verdad.
¿Hace falta estar en Reddit para que te citen?
Menos de lo que sugiere el consejo habitual, y ahora hay un conjunto de datos grande que complica la respuesta estándar.
Ahrefs analizó 1,4 millones de prompts de ChatGPT y publicó los resultados en abril de 2026. ChatGPT citó aproximadamente la mitad de las URL que recuperó. Lo interesante es el reparto por tipo de fuente: los resultados sacados de su índice de búsqueda se citaron el 88,46 % de las veces, mientras que Reddit se quedó en el 1,93 %, YouTube en el 0,51 % y las fuentes académicas en el 0,40 %.
O sea, que el modelo lee mucho esos sitios y los cita poco. Que se hable de ti en Reddit puede muy bien moldear lo que el modelo cree sobre tu categoría. Como vía hacia una cita real es mucho más floja que una página tuya que responda la pregunta con limpieza.
Conviene decirlo sin rodeos: Ahrefs vende un producto de visibilidad en IA, así que tiene un caballo en esta carrera. Los citamos porque la muestra es enorme y el método está publicado, no porque sean neutrales.
Otros dos hallazgos del mismo estudio merecen una nota adhesiva. Las páginas con slugs de URL en lenguaje natural se citaron el 89,78 % de las veces frente al 81,11 % de las que no los tenían. Y las páginas citadas mostraban más similitud semántica entre su título y la consulta, 0,602 contra 0,484 en las que se recuperaron y luego se descartaron.
Una conclusión deliciosamente aburrida. Escribe un título que coincida con la pregunta que alguien hace de verdad. Usa una URL legible. Con eso está casi todo.
¿Cómo sabes si un cambio es real?
Casi nunca lo sabes, y esta es la parte que nadie del negocio de las herramientas ofrece por su cuenta.
Las salidas de los asistentes no son deterministas. Lanza el mismo prompt dos veces y puedes obtener marcas distintas en otro orden, sin que haya cambiado nada de tu lado. Así que pasar de 6 menciones sobre 20 a 8 sobre 20 parece una mejora del 33 % en una diapositiva, y cabe cómodamente dentro del margen que obtendrías lanzando el conjunto idéntico dos veces la misma tarde.
Dos reglas te mantienen honesto.
- Lanza tu conjunto base dos veces el primer día. La diferencia que se abra entre esas dos ejecuciones idénticas es tu suelo de ruido. Cualquier cambio mensual menor que esa diferencia no es un resultado, por bien que quede en la presentación.
- Amplía el conjunto antes de fiarte de un movimiento pequeño. Veinte prompts dan una resolución gruesa. Si un desplazamiento de dos puntos cambia de verdad una decisión comercial, lo que necesitas son 50 o 100 prompts, no un panel más bonito.
Hay una tercera opción que no cuesta nada: lanza cada prompt tres veces y promedia, en lugar de una. Una ejecución es cara o cruz. Tres son una medición. Triplica tu tarde, así que nosotros solo lo haríamos con el puñado de prompts que importan comercialmente.
Honestamente, casi todo el movimiento mes a mes que se reporta en este campo es ruido con traje.
¿Qué hago si la puntuación es mala?
Arregla tu SEO primero, y ese consejo es de Google, no nuestro.
La guía de Google para optimizar de cara a las funciones de IA generativa se pregunta directamente si la práctica de SEO existente sigue aplicando. Su respuesta: "En resumen, sí. Las buenas prácticas de SEO siguen siendo relevantes porque nuestras funciones de IA generativa en la Búsqueda de Google se apoyan en nuestros sistemas centrales de ranking y calidad". Y va más lejos: "optimizar para la búsqueda con IA generativa es optimizar para la experiencia de búsqueda y, por tanto, sigue siendo SEO".
Esa misma guía enumera trabajo que puedes ahorrarte: archivos llms.txt, trocear el contenido, reescrituras específicas para IA y perseguir menciones poco auténticas. Eso es Google diciéndote por escrito que cuatro tácticas populares de GEO son innecesarias. Lo que sí recomienda es corriente y difícil: un punto de vista propio, contenido que no sea materia prima, cumplir los requisitos técnicos, una experiencia de página decente, menos contenido duplicado.
Más allá de eso, tu auditoría te dice cuál de tres problemas tienes.
Citada pero nunca recomendada. Tus páginas describen funciones mientras los prompts preguntan por situaciones. Ese hueco suele cerrarse escribiendo sobre el trabajo que está haciendo el comprador y no sobre la cosa que vendes, algo que cubrimos en el artículo sobre objeciones de cliente y jobs to be done.
Recomendada pero nunca citada. El modelo te conoce y no te manda a nadie. La respuesta suele ser que tus propias páginas no son la fuente más limpia disponible para esa afirmación, así que cita a otro describiéndote.
Ninguna de las dos, y los competidores por todas partes. Vuelve a la cuarta columna. Las páginas de terceros que sigan apareciendo son tu lista de objetivos, y entrar en una página de comparación o en un directorio suele ser más rápido que superarlo en el ranking.
Una nota sobre los bloques de FAQ, ya que todo el mundo pregunta. Ayudan como estructura y no como truco, y Google ha retirado los resultados enriquecidos de FAQ para casi todos los sitios, así que ya no hay premio de snippet. Lo que sí funciona es escribir una respuesta que se sostenga sola sin el párrafo de encima, porque un sistema de recuperación parte tu página en pasajes y puntúa cada uno por separado. Un SEO llamó a la ola actual de H2 con forma de pregunta "el keyword stuffing de antaño", y nos parece medio acertado. El formato está bien. Atornillarlo a páginas que no responden nada es lo que falla.
Hacer todo esto a mano deja de tener gracia alrededor del prompt doce. Lanzar el research y redactar la mitad de forma automática es más o menos para lo que construimos Aiter, aunque la primera auditoría vale la pena hacerla tú, porque ahí es donde aprendes qué significan los números.
En fin. Ve y pregúntale a ChatGPT cuál es la mejor herramienta de tu categoría, sin sesión iniciada, ahora mismo. Lo que vuelva es tu punto de partida real, y averiguarlo lleva unos cuarenta segundos.
Preguntas frecuentes (FAQ)
¿Cuánto lleva una auditoría de visibilidad en IA?
Unas tres horas para 20 prompts en tres asistentes, casi todo copiar y pegar. El segundo mes son cosa de una hora, una vez que existe la hoja.
¿Cuántos prompts necesito?
Veinte para ver la forma, 50 o más para detectar cambios pequeños con algo de confianza. Empieza en 20 y amplía solo cuando una decisión real dependa de esa precisión.
¿Lanzo los prompts con sesión iniciada o sin ella?
Sin sesión, en una ventana privada. Los resultados con sesión reflejan tu propio historial, lo que hace que tu marca aparezca mucho más de lo que aparece para un desconocido.
¿Puedo automatizarlo con la API de ChatGPT?
Puedes, y los resultados no coincidirán con la app de consumo. Las interfaces web superponen recuperación, herramientas y prompts de sistema sobre el modelo en bruto. Automatiza por volumen si quieres, pero no presentes la salida de la API como lo que ve un comprador.
¿Qué es una buena puntuación de visibilidad en IA?
No hay ninguna referencia que merezca citarse, porque la cuota de voz depende por completo de lo saturada que esté tu categoría. Tu propia línea de tendencia sobre un conjunto fijo de prompts es la única comparación que significa algo.
¿Ser citado por la IA trae tráfico de verdad?
A veces, y menos de lo que sugiere el recuento de citas. Quien lee un resumen donde apareces puede que no haga clic nunca. Trata las citas como prueba de inclusión y luego mira tus datos de referente en GA4 para el resto.
¿Existe alguna herramienta gratuita de visibilidad en IA?
Search Console y Bing Webmaster Tools informan de datos de IA gratis, y entre las dos cubren las superficies de Google y de Microsoft. Para cualquier otro asistente, la opción gratuita es tu propio tiempo y una hoja de cálculo.
¿Tengo que hacer esto cada mes?
Mensual le va bien a casi todos los equipos. Semanal mide sobre todo ruido, y trimestral va demasiado lento para conectar un efecto con el cambio de contenido que lo causó.