RadarMustDiagnóstico gratuito

21 de agosto de 2026

Seu site pode estar bloqueando a IA sem você saber (e por isso sua marca não aparece no ChatGPT)

Um site pode publicar conteúdo de altíssima qualidade, com autoridade real no assunto, e ainda assim nunca ser citado por nenhuma IA generativa — não porque o conteúdo seja ruim, mas porque um robô de IA nunca conseguiu, tecnicamente, chegar até ele. Isso acontece com mais frequência do que parece, e quase sempre sem ninguém ter decidido bloquear nada de propósito.

As três causas mais comuns, e nenhuma delas é intencional

Uma ferramenta de segurança bloqueando por padrão. Firewalls, plugins de proteção contra spam e configurações padrão de alguns provedores de hospedagem costumam bloquear, por padrão, qualquer robô não reconhecido como “confiável” — e boa parte dos robôs de IA (GPTBot, ClaudeBot, PerplexityBot) são recentes o suficiente pra não estarem na lista de exceção de ferramentas configuradas há mais tempo. O site continua no ar, o Google continua indexando normalmente, e só os robôs de IA ficam de fora — sem gerar nenhum erro visível pra quem administra o site.

Um robots.txt desatualizado. Muitos sites têm um arquivo robots.txt configurado há anos, pensado só pra buscadores tradicionais (Google, Bing), e nunca revisado depois que os robôs de IA passaram a existir. Sem uma linha específica liberando esses robôs, alguns sistemas mais restritivos tratam a ausência de permissão explícita como uma negação — o arquivo não precisa “proibir” nada de propósito pra causar o mesmo efeito.

Conteúdo que só aparece depois de rodar JavaScript. Se o conteúdo real da página só é montado depois que um script roda no navegador (comum em certas plataformas modernas sem cuidado extra de configuração), um robô que não executa JavaScript vê uma página praticamente vazia — mesmo que um visitante humano veja tudo normalmente. O Google, hoje, consegue renderizar boa parte do JavaScript antes de indexar; a maioria dos robôs de IA generativa, não.

Isso já é comum, e está crescendo

Segundo o USTA Index, um levantamento de julho de 2026 sobre os 100 mil domínios mais acessados do mundo, 19,1% dos sites com robots.txt válido bloqueiam pelo menos um robô de IA — e o GPTBot é o mais bloqueado de todos, por 8.432 sites. Outro levantamento, o AI Crawler Block Index, encontrou uma taxa ainda maior entre veículos de conteúdo: 22,4% dos publishers já bloqueiam algum robô de IA.

O problema não é só comum — está piorando. Segundo dados citados pela organização AI Visibility, a taxa de requisições de robôs de IA que recebem erro de acesso negado (HTTP 403) mais que dobrou em um ano, de 3,63% no segundo trimestre de 2025 para 8,56% no mesmo período de 2026. Ao mesmo tempo, a demanda desses robôs só cresce: segundo a própria Cloudflare, o volume de requisições do GPTBot cresceu 305% entre maio de 2024 e maio de 2025, saltando da nona pra terceira posição entre os robôs mais ativos rastreando a web — ou seja, mais robôs de IA tentando ler mais sites, e uma fatia crescente deles sendo barrada, sem que ninguém do lado bloqueado tenha decidido isso de propósito.

Por que isso não aparece em nenhum lugar óbvio

A parte mais traiçoeira desse problema é a ausência total de sinal. Não existe uma notificação, um erro no painel do site, ou uma queda visível de alguma métrica que aponte diretamente pra essa causa — o site continua funcionando normalmente pra qualquer visitante humano, continua sendo indexado pelo Google sem problema, e as métricas de tráfego orgânico tradicional seguem intocadas. O único sintoma é uma ausência: a marca nunca aparece numa resposta de IA sobre o próprio mercado, e é fácil atribuir isso a “falta de conteúdo bom” ou “falta de autoridade” — motivos reais em muitos casos, mas que nem chegam a ser testados enquanto o bloqueio técnico não é identificado e resolvido primeiro.

Descubra em minutos se o seu site está nesse grupo.

O Radar GEO testa, ao vivo, se os principais robôs de IA conseguem acessar o seu domínio — gratuito, sem cadastro pra ver o resultado inicial.

Testar meu site agora

Quais robôs, exatamente, precisam estar liberados

“Robô de IA” não é um agente só — é um conjunto de robôs diferentes, cada um de uma empresa diferente, cada um precisando da própria linha de permissão no robots.txt. Os mais relevantes hoje:

Robô Empresa Função
GPTBot, ChatGPT-User, OAI-SearchBot OpenAI Treinamento do modelo e busca ao vivo do ChatGPT
ClaudeBot, Claude-User Anthropic Treinamento e navegação de agente do Claude
Google-Extended Google Treinamento do Gemini (separado do Googlebot tradicional)
PerplexityBot, Perplexity-User Perplexity Indexação e busca ao vivo do Perplexity
CCBot Common Crawl Rastreamento aberto usado como dado de treino por diversos modelos, não só um
Bytespider ByteDance Treinamento de modelos da empresa dona do TikTok

Um robots.txt que só libera Googlebot e Bingbot — comum em configurações antigas, feitas antes de qualquer um desses robôs existir — deixa de fora, por omissão, praticamente todo o ecossistema de IA generativa relevante hoje.

Como conferir isso agora, sem ferramenta nenhuma

Três checagens simples, que qualquer pessoa consegue fazer sem depender de ferramenta paga:

Abra o robots.txt do seu site diretamente no navegador (seusite.com.br/robots.txt) e procure se há uma linha Disallow: / associada a algum User-agent de IA — GPTBot, ChatGPT-User, OAI-SearchBot, ClaudeBot, Google-Extended, PerplexityBot. Se nenhum desses nomes aparece no arquivo, o mais provável é que o arquivo nunca foi atualizado pra considerá-los — o que, dependendo de como o sistema que hospeda o site trata robôs não listados, pode significar bloqueio por omissão, não permissão.

Verifique as configurações de segurança do seu provedor de hospedagem ou CDN. Se o site usa Cloudflare ou outra ferramenta de proteção contra bots, existe geralmente um painel específico listando quais robôs estão sendo bloqueados ativamente — vale abrir esse painel e conferir se algum robô de IA aparece na lista de bloqueados, mesmo que ninguém tenha configurado isso conscientemente (é comum vir ativado por padrão em certos planos ou modos de proteção mais agressivos).

Desative o JavaScript do navegador e recarregue a página principal do site. Se o conteúdo essencial (texto, informação sobre o negócio) desaparecer completamente, é sinal de que o site depende de JavaScript pra existir — e um robô que não executa script vai ver exatamente essa versão vazia.

O que fazer se encontrar um bloqueio

Corrigir isso costuma ser rápido — é ajuste de configuração, não reforma de site. O ponto que mais atrasa a correção na prática é decidir com quem falar: normalmente é trabalho de quem cuida do desenvolvimento, da hospedagem ou da configuração de segurança do site, não de quem cuida de conteúdo, mídia paga ou redes sociais. É comum essa correção ficar parada por semanas só porque ninguém sabia claramente pra qual fornecedor ou área pedir o ajuste.

Depois de liberar o acesso, vale reforçar as outras frentes que também compõem a fundação técnica pra ser lido por IA — schema markup, um arquivo de descoberta específico pra IA, volume real de conteúdo — detalhadas com mais profundidade aqui. E se o seu negócio já resolveu essa parte técnica e quer confirmar se está de fato virando fonte citada, o guia completo de como aparecer no ChatGPT cobre o passo a passo seguinte, incluindo por que liberar os crawlers certos é justamente o primeiro dos oito passos, não um detalhe secundário.

Uma última recomendação, e talvez a mais importante: depois de corrigir o bloqueio, não presuma que resolveu — teste. Repita a mesma lógica descrita no case real de uma rede de franquias citada pelo ChatGPT poucos dias depois de resolver a fundação técnica: pergunte a uma IA algo sobre o seu mercado, sem citar sua marca, e confira se o resultado muda depois de algumas semanas. A correção técnica remove a barreira; não garante, sozinha e instantaneamente, que a citação apareça no dia seguinte.

Checklist rápido pra conferir agora

  • robots.txt libera explicitamente GPTBot, ChatGPT-User, OAI-SearchBot, ClaudeBot, Google-Extended e PerplexityBot
  • Nenhuma ferramenta de segurança, firewall ou CDN está bloqueando esses robôs por padrão
  • O conteúdo essencial da página continua visível com JavaScript desativado
  • O teste foi feito na página principal e em pelo menos uma página de conteúdo interna, não só na home

Erros comuns ao tentar corrigir isso

Liberar só um robô e presumir que resolveu todos. É comum alguém liberar o GPTBot no robots.txt, ver que funcionou, e parar por aí — esquecendo ClaudeBot, PerplexityBot e Google-Extended, cada um pertencendo a uma IA diferente que o cliente também pode estar usando pra pesquisar.

Corrigir o robots.txt e esquecer do firewall (ou o contrário). São duas camadas de bloqueio independentes — liberar um robô no robots.txt não desfaz um bloqueio configurado na ferramenta de segurança ou CDN, e vice-versa. Os dois lugares precisam ser conferidos separadamente.

Corrigir uma vez e nunca mais testar. Configurações de segurança são atualizadas, planos de hospedagem mudam, e uma correção feita hoje pode ser revertida sem aviso por uma atualização futura de alguma dessas ferramentas — vale reconferir periodicamente, não só na primeira vez que o problema foi identificado.

Tratar isso como responsabilidade do time de marketing. Quem escreve conteúdo ou cuida de mídia paga raramente tem acesso (ou motivo) pra mexer em configuração de servidor, robots.txt ou firewall — sem alguém do lado técnico envolvido desde o início, a correção tende a ficar prometida por semanas sem nunca sair do lugar.

Perguntas frequentes

Como um site bloqueia um robô de IA sem ninguém ter decidido isso? De três formas comuns: uma ferramenta de segurança bloqueando por padrão, um robots.txt desatualizado, ou conteúdo que só existe depois de rodar JavaScript.

Se meu site aparece bem no Google, isso já garante que os robôs de IA também conseguem ler ele? Não garante — são sistemas diferentes, com regras de acesso e capacidade de processar JavaScript diferentes entre si.

Só empresa grande corre esse risco? Não — é mais comum em sites pequenos e médios, justamente por não terem um time técnico revisando essas configurações periodicamente.

Quanto tempo leva pra corrigir, depois de identificado? Normalmente pouco — é ajuste de configuração. A parte difícil é descobrir que o bloqueio existe, não corrigi-lo.