SEO

    Como auditar a sua visibilidade em IA na mão em uma tarde (e por que o primeiro número vai estar errado)

    Dmytro25 de julho de 20267 min de leitura

    Dá para medir a visibilidade da sua marca nas respostas de IA em uma tarde, com uma planilha e sem assinatura nenhuma. Rode um conjunto fixo de 20 prompts, registre quatro coisas por prompt e repita todo mês no mesmo conjunto. É esse o método inteiro, e ele produz um número que você consegue defender numa reunião, o que já é mais do que vários painéis pagos conseguem.

    O motivo para fazer na mão pelo menos uma vez não tem nada de glamouroso. Enquanto você não rodar os prompts pessoalmente, não faz ideia do que a nota de uma ferramenta está contando, e vai balançar a cabeça diante de um gráfico que não significa nada.

    Um aviso justo sobre o primeiro número que você vai obter. Ele vai estar errado, e a última seção explica por que tudo bem.

    Como rodar uma auditoria de visibilidade em IA no ChatGPT, na Perplexity e no Google AI Mode usando um conjunto fixo de prompts

    O que é uma auditoria de visibilidade em IA?

    Uma auditoria de visibilidade em IA mede com que frequência um assistente cita, recomenda ou referencia a sua marca quando alguém faz uma pergunta de compra na sua categoria. Você escolhe os prompts que um comprador de verdade digitaria, roda em condições controladas e registra o resultado como dado, não como sensação.

    A parte controlada carrega todo o peso. Assistentes personalizam, leem o seu histórico de conversa e mudam de ideia entre uma rodada e outra. Uma auditoria que ignora esses três pontos está medindo a sua própria conta em vez do seu mercado, e vai te bajular, porque a sua conta passou o último ano lendo sobre a sua empresa.

    Por que se dar ao trabalho se já existem ferramentas?

    Porque uma nota que você não consegue reproduzir não é evidência, e porque esse setor tem um problema de honestidade que vale entender antes de gastar qualquer coisa.

    Alguém postou isso no r/DigitalMarketing pouco antes de a gente começar a escrever: "Nossos relatórios de visibilidade em IA parecem inventados. Sou só eu?". Não era só ele. Ivan Palii, que desenvolve software de SEO e portanto não tem motivo para bajular a categoria, testou sete das principais ferramentas de visibilidade em IA na mesma época e relatou que nenhuma delas mostrava tendência de visibilidade no nível de um prompt individual. Se uma ferramenta não consegue dizer qual prompt se moveu, o número de destaque dela é um anel do humor.

    Embaixo desse problema tem outro mais fundo. Uma revisão crítica de generative engine optimization publicada no arXiv em julho de 2026 analisou 45 estudos e concluiu que nenhuma técnica avaliada melhora de forma consistente a descoberta, o tráfego subsequente ou os resultados de negócio entre plataformas. O único experimento controlado que a área tem, o artigo GEO de Princeton aceito na KDD 2024, encontrou que a otimização podia "aumentar a visibilidade em até 40% nas respostas de mecanismos generativos", com eficácia variando por domínio.

    Leia os dois juntos e a ordem sensata é medir primeiro, comprar depois. Que é mais ou menos o inverso de como a maioria dos times chega. Compra o painel. Entra em pânico com o número. Pergunta o que o número significa. A gente já assistiu a essa sequência mais de uma vez e ela nunca fica menos engraçada de fora.

    Para levar: você não está fazendo na mão porque manual é virtuoso. Está fazendo uma vez para conseguir julgar se o número de uma ferramenta vale 90 dólares por mês, decisão que não dá para tomar de fora.

    Como rodar a auditoria: seis passos

    Passo 1. Escreva 20 prompts em quatro intenções

    Vinte é o bastante para enxergar um padrão e pouco o bastante para você realmente terminar. Divida em quatro:

    • Prompts de categoria, em que você não é mencionado: "melhor software de gestão de projetos para agências"
    • Prompts de comparação, nomeando dois concorrentes e não você: "Asana ou Monday para um time de 12 pessoas"
    • Prompts de recomendação com uma restrição: "CRM mais barato que faz sequências de e-mail por menos de 50 dólares por mês"
    • Prompts de objeção, os desconfortáveis: "vale a pena [sua categoria] para um fundador solo"

    Deixe o nome da sua marca fora de cada um dos prompts. Perguntar "a Aiter é boa" te conta como um assistente resume o nosso próprio site, que é uma pergunta diferente e bem menos útil do que se ele algum dia nos citaria por conta própria.

    Uma exceção, e ela vale o minuto extra. Rode "o que é [sua marca]?" uma vez por assistente como checagem separada, fora do conjunto pontuado. Ali você não está medindo visibilidade, está caçando alucinação nos seus dados de entidade. Fundador errado, preço errado, país errado, uma funcionalidade que você matou dois anos atrás. A gente encontrou uma descrição desatualizada de si mesma assim, e fazia meses que ela desinformava gente em silêncio.

    O montador aqui embaixo escreve o conjunto inteiro para você.

    Monte seu conjunto de 20 prompts

    Tudo roda no seu navegador. Nada é armazenado nem enviado.

    Categoria

    Sua marca não aparece. O conjunto mais difícil de ganhar e também o mais valioso.

    • melhor sua categoria para times pequenos
    • melhores ferramentas de sua categoria em 2026
    • qual é o melhor software de sua categoria
    • que sua categoria os especialistas recomendam
    • ferramentas de sua categoria que valem mesmo o preço

    Comparação

    Os concorrentes são citados e você não. Testa se o modelo chega até você sozinho.

    • Concorrente A ou Concorrente B, qual é melhor
    • alternativas ao Concorrente A
    • vale a pena Concorrente A em comparação com Concorrente B
    • Concorrente B ou Concorrente A para um time de cinco
    • trocar Concorrente A por algo mais barato

    Recomendação

    Pedidos com restrição. Esses convertem, porque quem pergunta já decidiu comprar.

    • sua categoria mais barato que funcione de verdade
    • sua categoria para um time de cinco por menos de US$ 100 por mês
    • sua categoria mais fácil de configurar em um dia
    • melhor sua categoria para quem não tem orçamento
    • sua categoria que não precisa de desenvolvedor

    Objeção

    As perguntas chatas. Quase ninguém faz, e as respostas dizem muito.

    • vale a pena sua categoria para um fundador sozinho
    • eu preciso mesmo de sua categoria
    • por que sua categoria é tão caro
    • problemas comuns com ferramentas de sua categoria
    • dá para fazer sua categoria na mão

    Rode cada um deslogado, numa janela anônima, e anote se você foi citado, recomendado ou usado como fonte. Três colunas, não uma.

    Passo 2. Rode cada prompt deslogado, numa sessão nova

    Saia da conta. Use uma janela anônima. Não deixe o assistente ver o seu histórico, porque a personalização vai te entregar um resultado lisonjeiro sem avisar e você vai acreditar.

    Rode os mesmos 20 prompts em cada assistente que te interessa. A maioria dos times escolhe três: ChatGPT, Google AI Mode e Perplexity. Acrescente o Claude se você vende para desenvolvedores. Acrescente o Copilot se você vende para empresas grandes onde o TI escolheu Microsoft para todo mundo.

    Não acrescente os seis. Cada assistente extra multiplica o trabalho por vinte prompts e adiciona ruído à sua média sem mudar uma única decisão que você vai tomar.

    Passo 3. Registre quatro colunas separadas, não uma nota

    As ferramentas colapsam tudo isso num número só, e o detalhe que elas achatam é justamente o detalhe que diz o que consertar na semana que vem.

    ColunaO que significaPor que merece coluna própria
    CitadaSua marca aparece em algum ponto da respostaMais barata de conquistar, sinal mais fraco
    RecomendadaVocê é apresentado como opção sugeridaA que acompanha o pipeline
    ReferenciadaSeu domínio aparece como fonte com linkA que gera tráfego de verdade
    Quem mais apareceuTodas as outras marcas na respostaA coluna mais útil da planilha

    As três primeiras separam três doenças genuinamente diferentes. Uma marca pode ser referenciada o tempo todo e recomendada nunca, o que é problema de conteúdo. Ou recomendada sem nunca ser referenciada, o que significa que o modelo te conhece mas não manda ninguém na sua direção. Um número só esconde as duas.

    A quarta coluna é a que quase todo mundo pula, e é a que paga a conta. Um SEO no r/SEO colocou melhor do que a gente colocaria: essa última coluna te diz por que os concorrentes são escolhidos, e a resposta costuma ser páginas de comparação, diretórios e threads de fórum em vez de qualquer coisa no site do próprio concorrente. Você não está só se medindo. Está ganhando um mapa gratuito de quais páginas de terceiros o modelo confia na sua categoria, e entrar nessas páginas quase sempre é mais fácil do que ultrapassá-las.

    Passo 4. Calcule share of voice contra três concorrentes nomeados

    Para cada prompt, registre quais concorrentes apareceram. Depois calcule o share of voice: suas menções divididas por todas as menções de marca no conjunto.

    Escolha três concorrentes e mantenha essa lista firme. Trocar o conjunto de comparação entre os meses é a maneira mais fácil do mundo de fingir progresso, e se você reporta para outra pessoa, uma hora ela percebe.

    Passo 5. Anote os metadados chatos

    Data, assistente, versão do modelo se estiver visível, país e se você estava deslogado.

    Pule isso e a comparação do mês que vem não vale nada, porque você não vai ter ideia se o que mudou foi o número ou as condições. A gente já pulou. Não valeu nada.

    Passo 6. Repita todo mês no conjunto idêntico

    Mesmos prompts, mesma ordem, mesmas condições. Mude o conjunto e você começou um experimento novo em vez de continuar o antigo.

    Mensal é a cadência certa para quase todo mundo. Semanal mede sobretudo ruído, e trimestral é tão lento que você já vai ter esquecido qual mudança de conteúdo estava testando.

    Quais ferramentas gratuitas usar junto da auditoria manual?

    Quatro, todas gratuitas, e juntas cobrem a metade do quadro que o seu conjunto de prompts não alcança.

    1. O relatório de IA generativa do Search Console. Impressões das AI Overviews e do AI Mode, direto do Google. Sem cliques e sem consultas, então leia o que ele mostra e o que esconde antes de montar um relatório em cima.
    2. Bing Webmaster Tools. Verifique o site mesmo que o Bing não te mande nada. O painel de AI Performance dele reporta grounding queries, as frases que o assistente escreve para si mesmo ao sair atrás de fontes. É o único dado gratuito em nível de consulta que alguém publica.
    3. GA4, segmentado por referenciador. Tráfego chegando de chatgpt.com, perplexity.ai e companhia. Números pequenos hoje para a maioria dos sites, mas é a única coluna desta lista que se conecta a receita.
    4. Seus logs de servidor ou o painel da CDN. Quais crawlers de IA estão buscando o quê, e se alguma coisa está bloqueando eles.

    O quarto item merece uma ressalva, porque é onde boa parte do conselho de GEO se empolga. Acesso de crawler é real e vale conferir uma vez. Mas raramente é a coisa errada. Um SEO que auditou por volta de 17.000 sites de pequenas empresas neste ano resumiu no r/SEO: acesso quase nunca é o gargalo, o robots.txt em geral está ok, o GPTBot em geral não está bloqueado. O que mata esses sites é que nada na página consegue ser extraído como resposta.

    Para levar: confira o acesso dos crawlers uma vez, conserte se estiver quebrado e pare de olhar. Trate os logs de bot como camada de depuração e a auditoria de prompts como o seu KPI de verdade.

    Preciso estar no Reddit para ser citado?

    Menos do que o conselho sugere, e agora existe um conjunto de dados grande que complica a resposta padrão.

    A Ahrefs analisou 1,4 milhão de prompts do ChatGPT e publicou os resultados em abril de 2026. O ChatGPT citou por volta de metade das URLs que recuperou. A parte interessante é a divisão por tipo de fonte: resultados puxados do índice de busca dele foram citados em 88,46% das vezes, enquanto o Reddit ficou em 1,93%, o YouTube em 0,51% e fontes acadêmicas em 0,40%.

    Ou seja, o modelo lê muito esses lugares e quase nunca os cita. Ser discutido no Reddit pode muito bem moldar o que um modelo acredita sobre a sua categoria. É um caminho bem mais fraco para uma citação de verdade do que uma página sua que responde à pergunta de forma limpa.

    Vale dizer com todas as letras: a Ahrefs vende um produto de visibilidade em IA, então tem interesse na corrida. A gente cita porque a amostra é enorme e o método está publicado, não porque eles sejam neutros.

    Duas outras conclusões do mesmo estudo merecem um post-it. Páginas com slug de URL em linguagem natural foram citadas 89,78% das vezes contra 81,11% das que não tinham. E páginas citadas mostraram maior similaridade semântica entre título e consulta, 0,602 contra 0,484 nas páginas que foram recuperadas e depois descartadas.

    O que é uma conclusão deliciosamente sem graça. Escreva um título que combine com a pergunta que alguém realmente faz. Use uma URL legível. É quase tudo.

    Como saber se uma mudança é real?

    Na maior parte das vezes você não sabe, e essa é a parte que ninguém do ramo de ferramentas oferece por conta própria.

    Saídas de assistente não são determinísticas. Rode o mesmo prompt duas vezes e você pode receber marcas diferentes em ordem diferente, sem nenhuma mudança do seu lado. Então passar de 6 menções em 20 para 8 em 20 parece um ganho de 33% num slide, e cabe confortavelmente na faixa que você obteria rodando o conjunto idêntico duas vezes na mesma tarde.

    Duas regras te mantêm honesto.

    1. Rode o conjunto da linha de base duas vezes no primeiro dia. A diferença que abrir entre essas duas rodadas idênticas é o seu piso de ruído. Qualquer mudança mensal menor que essa diferença não é resultado, por melhor que fique na apresentação.
    2. Amplie o conjunto antes de confiar num movimento pequeno. Vinte prompts te dão resolução grosseira. Se uma variação de dois pontos muda mesmo uma decisão comercial, você precisa de 50 ou 100 prompts, não de um painel mais bonito.

    Existe uma terceira opção que não custa nada: rodar cada prompt três vezes e tirar a média, em vez de uma só. Uma rodada é cara ou coroa. Três rodadas são medição. Isso triplica a sua tarde, então a gente faria só para o punhado de prompts que importam comercialmente.

    Sinceramente, a maior parte do movimento mês a mês reportado nessa área é ruído de gravata.

    O que fazer diante de uma nota ruim?

    Consertar o seu SEO primeiro, e o conselho é do Google, não nosso.

    O guia do Google para otimizar para recursos de IA generativa pergunta diretamente se a prática atual de SEO continua valendo. A resposta dele: "Resumindo, sim. As boas práticas de SEO continuam relevantes porque os nossos recursos de IA generativa na Busca do Google têm raiz nos nossos sistemas centrais de ranqueamento e qualidade da Busca". Vai além, afirmando que "otimizar para a busca com IA generativa é otimizar para a experiência de busca, e portanto ainda é SEO".

    Esse mesmo guia lista trabalho que dá para pular: arquivos llms.txt, fragmentação de conteúdo, reescritas específicas para IA e a caça a menções inautênticas. É o Google dizendo por escrito que quatro táticas populares de GEO são desnecessárias. O que ele recomenda é comum e difícil: um ponto de vista próprio, conteúdo que não seja commodity, atender aos requisitos técnicos, experiência de página decente, menos conteúdo duplicado.

    Fora isso, a sua auditoria diz qual dos três problemas você tem.

    Referenciado mas nunca recomendado. Suas páginas descrevem funcionalidades enquanto os prompts perguntam sobre situações. Essa distância costuma fechar quando você escreve sobre a tarefa que o comprador está tentando cumprir em vez da coisa que você vende, assunto que a gente cobriu no texto sobre objeções de cliente e jobs to be done.

    Recomendado mas nunca referenciado. O modelo te conhece e não manda ninguém. Em geral a explicação é que as suas próprias páginas não são a fonte mais limpa disponível para aquela afirmação, então ele cita outra pessoa descrevendo você.

    Nenhum dos dois, e os concorrentes estão em tudo. Volte para a coluna quatro. As páginas de terceiros que ficam aparecendo são a sua lista de alvos, e entrar numa página de comparação ou num diretório normalmente é mais rápido do que ultrapassar um deles.

    Uma palavra sobre blocos de FAQ, já que todo mundo pergunta. Eles ajudam como estrutura e não como truque, e o Google aposentou os rich results de FAQ para a maioria dos sites, então não existe mais prêmio de snippet. O que funciona de fato é escrever uma resposta que se sustenta sozinha, sem o parágrafo acima dela, porque um sistema de recuperação divide a sua página em trechos e pontua cada um separadamente. Um SEO chamou a onda atual de H2 em formato de pergunta de "o keyword stuffing de antigamente", e a gente acha isso meio certo. O formato está ok. Parafusar ele em páginas que não respondem nada é o que falha.

    Fazer tudo isso na mão deixa de ser divertido lá pelo prompt doze. Rodar a pesquisa e metade da redação de forma automática é mais ou menos o que a gente construiu na Aiter, embora a primeira auditoria valha a pena ser feita por você, porque é ali que se aprende o que os números significam.

    Enfim. Vá perguntar ao ChatGPT qual é a melhor ferramenta da sua categoria, deslogado, agora. O que voltar é a sua linha de base real, e leva uns quarenta segundos para descobrir.

    Perguntas frequentes (FAQ)

    Quanto tempo leva uma auditoria de visibilidade em IA?

    Por volta de três horas para 20 prompts em três assistentes, quase tudo copiar e colar. O segundo mês leva mais ou menos uma hora, já com a planilha pronta.

    De quantos prompts eu preciso?

    Vinte para enxergar o formato, 50 ou mais para detectar mudanças pequenas com alguma confiança. Comece com 20 e amplie só quando uma decisão real depender da precisão.

    Devo rodar os prompts logado ou deslogado?

    Deslogado, numa janela anônima. Resultados logados refletem o seu próprio histórico, o que faz a sua marca aparecer muito mais do que aparece para um estranho.

    Dá para automatizar com a API do ChatGPT?

    Dá, e os resultados não vão bater com o aplicativo de consumo. As interfaces web colocam recuperação, ferramentas e prompts de sistema por cima do modelo bruto. Automatize por volume se quiser, mas não apresente saída de API como aquilo que um comprador vê.

    O que é uma boa nota de visibilidade em IA?

    Não existe referência que valha citar, porque share of voice depende inteiramente de quão lotada é a sua categoria. A sua própria linha de tendência num conjunto fixo de prompts é a única comparação que significa alguma coisa.

    Ser citado pela IA traz tráfego mesmo?

    Às vezes, e menos do que a contagem de citações sugere. Quem lê um resumo que menciona você pode nunca clicar. Trate as citações como evidência de inclusão e depois confira os dados de referenciador no GA4 para o resto.

    Existe ferramenta gratuita de visibilidade em IA?

    O Search Console e o Bing Webmaster Tools reportam dados de IA de graça, e juntos cobrem as superfícies do Google e da Microsoft. Para qualquer outro assistente, a opção gratuita é o seu tempo e uma planilha.

    Preciso fazer isso todo mês?

    Mensal serve para a maioria dos times. Semanal mede sobretudo ruído, e trimestral é lento demais para ligar um efeito de volta à mudança de conteúdo que o causou.