A maioria das auditorias técnicas de SEO entrega uma lista de duzentos itens e nenhuma prioridade.
Isso não ajuda quem decide.
Ajuda quem já sabe implementar e só queria uma confirmação por escrito.
Uma auditoria de verdade responde uma pergunta bem mais simples: o que, se corrigido primeiro, libera mais visibilidade presa agora?
Essa pergunta importa mais em 2026 do que importava há dois anos, e por um motivo específico.
A base técnica que decide se o Google rastreia seu site é a mesma que decide se o ChatGPT consegue citar você. Só que são rastreadores diferentes, com regras diferentes, e a maioria das empresas trata os dois como se fossem a mesma coisa.
O diagnóstico errado: tratar SEO técnico como checklist de completude
Procure por auditoria técnica de SEO em qualquer lugar e você vai encontrar listas de cem, duzentos itens.
- Meta tag,
- Sitemap,
- Canonical,
- Redirecionamento,
- Hreflang,
- Profundidade de clique,
tudo junto, sem ordem de impacto.
Completude não é prioridade.

Nenhuma empresa vai fechar a lista inteira em um trimestre, e mesmo que fechasse, nem todo item pesa igual.
Corrigir um atributo alt de imagem e corrigir um robots.txt que está bloqueando o rastreador certo não estão no mesmo patamar de urgência, mas aparecem lado a lado na maioria dessas listas.
O efeito prático é previsível.
O time técnico recebe duzentos itens, prioriza pelo que é mais fácil de resolver, não pelo que mais importa, e a operação sente que “fez SEO técnico” sem que nada de relevante tenha mudado na visibilidade real.
Isso é ainda mais grave agora que existe uma segunda audiência lendo o seu site além do Google: os mecanismos de IA.
E aqui o erro de checklist fica mais caro, porque envolve algo que a maioria das empresas nunca configurou de propósito.
A causa real: dois tipos de rastreador, duas prioridades diferentes
Existe uma confusão que provavelmente está acontecendo agora mesmo em alguma empresa, e ela nasce de um mal-entendido técnico simples.
A OpenAI não opera um crawler de IA.
Opera quatro, cada um com uma função diferente.
O GPTBot coleta conteúdo para treinar modelos futuros, e bloqueá-lo é a forma de dizer que seu conteúdo não deve virar dado de treinamento.
O OAI-SearchBot é o que leva o seu site para dentro dos resultados de busca do próprio ChatGPT, e bloqueá-lo tira sua marca dessas respostas.
O ChatGPT-User age em tempo real, quando alguém pede diretamente para o ChatGPT abrir uma página sua.
E o OAI-AdsBot só visita páginas que a própria empresa submeteu como anúncio.
A Anthropic segue a mesma lógica com três crawlers documentados.
O ClaudeBot coleta para treinamento.
O Claude-SearchBot indexa conteúdo para melhorar a qualidade das respostas de busca.
O Claude-User busca uma página específica a pedido de quem está conversando com o Claude naquele momento.

| Empresa | Robô | O que faz | Bloquear afeta |
|---|---|---|---|
| OpenAI | GPTBot | Coleta conteúdo para treinar modelos futuros | Seu conteúdo não entra em treinamento |
| OpenAI | OAI-SearchBot | Leva seu site para as buscas dentro do ChatGPT | Você some das respostas de busca do ChatGPT |
| OpenAI | ChatGPT-User | Abre uma página específica a pedido do usuário | Uma citação pontual, em tempo real |
| OpenAI | OAI-AdsBot | Valida páginas submetidas como anúncio | Apenas anúncios enviados à plataforma |
| Anthropic | ClaudeBot | Coleta conteúdo para treinar modelos futuros | Seu conteúdo não entra em treinamento |
| Anthropic | Claude-SearchBot | Indexa conteúdo para melhorar respostas de busca | Você some das respostas de busca do Claude |
| Anthropic | Claude-User | Abre uma página específica a pedido do usuário | Uma citação pontual, em tempo real |
Aqui está o problema que essa tabela existe para prevenir.
É comum alguém do time técnico, preocupado com uso de conteúdo para treinar modelo concorrente, bloquear “os robôs de IA” no robots.txt de forma genérica, geralmente com uma regra que pega qualquer user agent contendo a palavra “bot” ou “gpt”.
Se essa regra pegar o OAI-SearchBot e o Claude-SearchBot junto com o GPTBot e o ClaudeBot, a empresa não protegeu seu conteúdo de nada relevante.
Ela se tornou invisível para citação em tempo real, que é exatamente o resultado oposto do que a área de marketing está tentando construir com todo o investimento em conteúdo para AI Search.
É a mesma lógica de unidade errada que aparece em menção, citação e recomendação em AI Search: a empresa mede se está bloqueando IA, quando a decisão real acontece por robô, não por categoria.
Fechar a porta de treinamento sem fechar junto a porta de busca é uma decisão legítima.
Fechar as duas sem perceber que são portas diferentes é o erro que este artigo existe para evitar.
Como identificar se sua operação tem esse problema
Quatro sinais, todos fáceis de verificar em uma tarde, e nenhum deles aparece em relatório de tráfego.
Ninguém no time consegue listar, de memória, quais robôs estão bloqueados no robots.txt agora.
Se a resposta exige abrir o arquivo para descobrir, é sinal de que a configuração foi feita uma vez e nunca mais revisada.
O conteúdo das páginas de conversão, preço, produto, formulário, carrega via JavaScript sem que ninguém tenha testado como ele aparece para um rastreador que não executa JavaScript da mesma forma que um navegador.
Ninguém mediu Interaction to Next Paint nas páginas de maior intenção comercial.
A métrica que substituiu o antigo First Input Delay como Core Web Vital oficial avalia a resposta de todas as interações da visita, não só a primeira, e o padrão do Google considera bom até 200 milissegundos, precisa melhorar entre 200 e 500, e ruim acima de 500.
Formulário complexo e calculadora de ROI, exatamente o tipo de página que mais importa para pipeline em B2B, são as que mais sofrem quando essa métrica nunca foi olhada.
E a navegação por filtro do site gera milhares de combinações de URL que competem pelo mesmo orçamento de rastreamento que o Google dedica ao seu domínio, sem que nenhuma dessas combinações tenha valor de busca próprio.
O que fazer, sem lista de duzentos itens
Quatro movimentos, nesta ordem, porque cada um informa o seguinte.
Primeiro, auditar o robots.txt nomeando cada robô de IA explicitamente.
Não usar regra genérica por palavra-chave no user agent.
Decidir, robô por robô, se a empresa quer permitir treinamento, quer aparecer em busca de IA, ou as duas coisas, e escrever essa decisão de forma literal no arquivo.
Segundo, olhar os logs do servidor pelos últimos trinta dias para ver quem está rastreando de verdade, em vez de supor.
É comum descobrir que um robô que a empresa achava estar liberado nunca apareceu nos logs, porque algo na infraestrutura, um firewall, um WAF, uma regra de CDN, está barrando antes mesmo do robots.txt entrar em ação.
Terceiro, testar como as páginas que geram pipeline são renderizadas, não o site inteiro.
Não é necessário auditar o blog institucional com a mesma urgência da página de preço.
Comece pelas dez URLs que mais influenciam receita e verifique se o conteúdo relevante está presente quando o JavaScript não executa.
Quarto, medir Interaction to Next Paint nessas mesmas dez páginas antes de qualquer decisão de redesign.
Corrigir uma experiência de conversão para depois descobrir que o problema técnico persiste é o tipo de retrabalho que uma auditoria bem priorizada evita.
Nenhum desses quatro passos exige contratar uma ferramenta nova. Exige decidir o que checar primeiro, que é o oposto do checklist de duzentos itens.
Esses quatro movimentos resolvem a camada de acesso, que é pré-requisito para tudo o mais. Depois dela, valem as táticas de conteúdo que já tratei em Schema para AI Search e em FAQ para AI Search.
Sem a base técnica liberada, marcação de schema e FAQ bem estruturado não têm quem os leia.
O padrão que aparece nos projetos
O padrão mais comum, composto a partir de situações recorrentes em operações de tecnologia B2B, é o seguinte.
Uma empresa está investindo em conteúdo para aparecer em respostas de ChatGPT e Perplexity. O time de marketing publica, mede menção e citação, e os números não saem do zero, mesmo em prompts que deveriam favorecer a marca.
A causa raramente está no conteúdo.
Está num WAF configurado anos atrás para conter scraping malicioso, com uma regra que bloqueia qualquer user agent contendo a palavra “bot”.
Essa regra nunca foi revisada depois que os crawlers de IA passaram a existir, e ela pega o OAI-SearchBot e o Claude-SearchBot junto com tudo que parece automação maliciosa.
O time de marketing está pagando para ser encontrado.
O time de infraestrutura, sem saber, está fechando a porta antes de qualquer conteúdo ter chance de ser lido.
O efeito não fica restrito ao ChatGPT ou ao Claude.
O mesmo tipo de bloqueio silencioso ajuda a explicar quedas de visibilidade em AI Overviews do Google, porque a infraestrutura de rastreamento que sustenta essas duas camadas se sobrepõe mais do que a maioria das equipes técnicas percebe.
Perguntas frequentes
O que é crawl budget?
É a quantidade de páginas que um rastreador está disposto a visitar no seu site dentro de um período. Em sites grandes, navegação por filtro e páginas duplicadas competem por esse orçamento com as páginas que realmente importam para receita.
Devo bloquear o GPTBot?
Depende do que a empresa decide sobre uso do próprio conteúdo em treinamento de modelo. Bloquear o GPTBot não bloqueia automaticamente o OAI-SearchBot, que é o robô responsável por levar o site às buscas dentro do ChatGPT. São decisões independentes.
Bloquear treinamento de IA afeta minha citação no ChatGPT?
Não deveria, se a configuração for feita corretamente, nomeando cada robô. O erro comum é usar uma regra genérica que bloqueia treinamento e busca ao mesmo tempo, sem essa ser a intenção.
O que é INP e o que ele substituiu?
Interaction to Next Paint é a métrica de Core Web Vital que substituiu o First Input Delay. Ela mede a resposta de todas as interações de uma visita, não só a primeira, o que a torna mais representativa da experiência real em páginas com formulário ou calculadora.
SEO técnico ainda importa se eu já invisto em AI Search?
Importa mais. A base técnica que permite ao Google rastrear seu site é, em grande parte, a mesma que permite aos mecanismos de IA encontrar e citar seu conteúdo. Investir em conteúdo para AI Search sobre uma base técnica quebrada é gastar em cima de uma porta fechada.
O que fazer agora
Não comece pela lista de duzentos itens. Comece pelos logs do servidor dos últimos trinta dias e descubra quem está rastreando seu site de verdade, e quem deveria estar rastreando e não está.
Se o OAI-SearchBot ou o Claude-SearchBot não aparecem nos logs, isso vale mais que qualquer outro item de checklist técnico, porque significa que todo investimento em conteúdo para AI Search está batendo numa porta fechada antes de qualquer leitor de IA ter a chance de ler.
Fontes
- OpenAI. Overview of OpenAI crawlers.
- Anthropic. Does Anthropic crawl data from the web, and how can site owners block the crawler?
- web.dev. Interaction to Next Paint (INP).
Se você se identifica ou está passando por este momento na sua empresa, o Diagnóstico de Growth mapeia gargalos em aquisição, CRM, pipeline e vendas, incluindo a base técnica que sustenta essa visibilidade, antes de recomendar qualquer novo investimento.
→ Conhecer o Diagnóstico de Growth
O Radar de Growth é um diagnóstico gratuito que mapeia onde sua aquisição, CRM e pipeline estão perdendo eficiência. Leva menos de 2 minutos, em 4 etapas curtas de seleção. O resultado chega por email com um resumo do que precisa de atenção primeiro.

