Peguei o ChatGPT e perguntei pelo que a minha empresa faz. Eu não aparecia. Não era texto ruim, não era falta de SEO: a opção de bloquear robô de inteligência artificial estava ligada — e ninguém do meu time tinha ligado. Eu tenho centenas de domínios nesse painel. Fui investigar log pra entender de onde saía aquilo.
Resposta rápida: se o seu site não aparece quando alguém pergunta pro ChatGPT, a primeira coisa a checar não é o conteúdo — é se o robô consegue entrar. Existe uma chave no painel do CDN que bloqueia os robôs de IA (o do ChatGPT, o do Claude, o do Gemini) e ela vem ligada por padrão em domínio novo desde 1º de julho de 2025, por decisão pública da Cloudflare. Em 15 de setembro de 2026 os padrões mudaram de novo e agora o robô é separado por comportamento — busca, treino e agente, o que permite recusar treino sem sumir da busca. Vá em Security Settings → Configure AI bot policies, olhe também o robots.txt e as regras de bot (é em mais de um lugar, por isso confunde) e libere os robôs de busca: OAI-SearchBot, Claude-SearchBot, Googlebot. Leva quinze minutos e não custa nada.
Gravei esses 6 minutos no canal @josimarjmv em 22 de setembro de 2026, sem edição, do jeito que eu gravo: essa câmera e essa câmera. Assista e leia junto — aqui embaixo eu conto a mesma coisa com calma e com o que eu fui conferir depois, na documentação de cada empresa, com data.
🎧 PREFERE OUVIR? · 6 min
Este artigo também é um episódio do podcast Josimar JMV | Em Produção — o mesmo vídeo, só o áudio, normalizado pra fone.
Vou dar a minha carteirada antes, senão isso aqui vira mais um texto de gente repetindo dica de SEO que leu em outro lugar. Eu tenho uma empresa de tecnologia e sou dono mesmo — não é aquele "sou CEO" de perfil bonito. Eu cuido de venda, de marketing e de suporte, e eu sou mão na massa: gerencio infraestrutura, hardware de verdade, a parte de rede, lógica, deploy, git, versionamento. São milhões de views todos os dias que eu ponho a mão pra cuidar e arquitetar.
Digo isso por um motivo prático: o que eu vou contar aqui eu não li. Eu tropecei nele dentro da minha própria operação, com centenas de domínios num painel só, e fui atrás do log até achar. E, quando eu fui preparar as aulas da minha imersão de sites, vi a mesma coisa no site de aluno e até num site antigo meu. Não é caso isolado — é um monte de gente com o site no ar, bonito, funcionando, e invisível pras inteligências artificiais, sem fazer a menor ideia do porquê.
Deixa eu contar do jeito que aconteceu. Você abre o ChatGPT e pergunta o que qualquer cliente seu perguntaria: "qual a melhor clínica", "qual o melhor isso", "qual o melhor aquilo". Eu fiz isso com o que eu vendo. Perguntei por TV indoor vertical.
Pergunta aí agora que eu já estou lá. Mas eu não estava dias atrás. E a diferença entre não estar e estar não foi artigo novo, não foi backlink, não foi palavra-chave: foi uma chave desligada no painel. Esse é o tamanho da bobagem — e é justamente por ser bobagem que ninguém procura ali.
Quem trabalha com site sabe a sensação: você mexe no site, publica, faz aquele tanto de coisa, manda pergunta e não aparece. Manda de novo, não aparece. E você não entende. Fica achando que é o algoritmo, que é concorrência, que é sorte. Não é nada disso. O robô nem chegou a ler a sua página.
A primeira coisa que eu quis entender foi a origem. A gente tem centenas de sites na Cloudflare e, em muitos deles, nós não colocamos essa opção manualmente. A gente investigou log e tudo. A conclusão foi essa: a própria Cloudflare ativou nativamente.
E o motivo, na origem, faz sentido. Sabe os jornais grandes do Brasil? Folha, esse pessoal todo. Eles não querem que fiquem fazendo scrap do conteúdo deles — raspar, catar o texto da página e jogar num portal automatizado. É uma briga legítima e antiga. O problema é que a solução que nasceu pra proteger jornal virou padrão pra todo mundo, inclusive pro seu site de cinco páginas que só queria ser encontrado.
Apuração minha (23/09/2026), porque na gravação eu falei isso de cabeça: não é impressão, é anunciado. Em 1º de julho de 2025, no que chamou de Content Independence Day, a Cloudflare anunciou que todo domínio novo passaria a começar bloqueando os robôs de IA — a empresa cuida do tráfego de cerca de 20% da web, então isso não é detalhe de nicho, é uma fatia enorme da internet mudando de comportamento de uma vez.
E mudou de novo, uma semana antes de eu gravar: em 15 de setembro de 2026 a Cloudflare reorganizou os robôs por comportamento — Search (indexar pra responder depois), Training (treinar ou afinar modelo) e Agent (agente abrindo a página em nome de uma pessoa, na hora). O padrão novo de domínio com anúncio ficou: busca liberada, treino recusado, agente bloqueado nas páginas com anúncio. Sem anúncio, tudo liberado. Quem já tinha configuração antiga foi migrado: o velho "Block AI Bots" virou "Disallow AI Training".
Na gravação eu disse que, se eu não me engano, são três locais diferentes onde essa trava aparece. Fui conferir com calma pra te dar o caminho certo em vez de te deixar procurando.
O caminho oficial hoje é Security Settings → Configure AI bot policies, e está disponível do plano grátis pra cima (documentação da Cloudflare). A sensação de "está em três lugares" tem fundamento: o mesmo efeito de bloqueio aparece também no robots.txt gerenciado e nas regras de bot. Então o roteiro é esse, e nessa ordem:
seudominio.com/robots.txt no navegador e procure por GPTBot, ClaudeBot e Google-Extended. Se estiver tudo com Disallow: /, pronto, está explicado.Desligar num lugar e esquecer do outro é o erro mais comum — e é o que faz a pessoa jurar que liberou e continuar sem aparecer. Confira os três.
Aqui entra a parte que eu fui conferir depois de gravar, porque eu falei "o bot da OpenAI, o bot do Claude, o bot do Gemini" e na prática cada empresa tem mais de um robô, com funções diferentes. E isso muda tudo, porque você pode querer um e não querer o outro:
GPTBot pra treino, OAI-SearchBot pra busca dentro do ChatGPT e ChatGPT-User pra quando o usuário manda abrir um endereço específico.ClaudeBot pra treino, Claude-SearchBot pra busca e Claude-User pro pedido do usuário. A empresa declara que os três respeitam o robots.txt, inclusive o do usuário.Googlebot é a Busca; Google-Extended é só o treino do Gemini.Se o que você quer é aparecer na resposta — e é isso que traz cliente —, quem tem que estar liberado é o robô de busca: OAI-SearchBot, Claude-SearchBot, Googlebot. Bloquear tudo de uma vez pra "proteger o conteúdo" é jogar fora justamente a parte que te dá visibilidade.
Tem gente que não quer aparecer por ideologia, e eu respeito: é o seu conteúdo, você decide. Mas até pouco tempo a decisão era tudo ou nada, e muita gente se bloqueou inteira sem querer.
Hoje não é mais assim. A opção Disallow AI Training que entrou em 15 de setembro publica a recusa de treino mantendo a indexação pra busca — e, segundo a própria Cloudflare, Apple, Google e Microsoft honram ou se comprometeram a honrar essa preferência. Do lado do Google a regra já era essa e está escrita na documentação de crawlers: "Google-Extended does not impact a site's inclusion in Google Search nor is it used as a ranking signal in Google Search". Traduzindo pro nosso lado: bloquear o Google-Extended não tira você do Google. Tira você do treino do Gemini. São chaves diferentes, e confundir as duas é o que mais dá prejuízo.
Uma curiosidade que eu queria dividir, porque é assustadora quando você vê pela primeira vez. Eu tenho o Google Analytics integrado e, de vez em quando, eu fico olhando: tem época do mês específica em que os robôs chineses invadem todos os sites e validam tudo de novo. Você abre o relatório e vê uma rajada de visita vinda da China. Faça o teste no seu e me conta no comentário do vídeo se acontece igual.
Aqui vale a minha nota de honestidade: eu não sei de quem é e não vou chutar nome. O que eu sei, e isso é o que interessa pro seu dia a dia, é que o robots.txt é pedido, não é muro. Quem respeita, respeita. Quem não respeita, entra do mesmo jeito. Por isso eu não trato robots.txt como segurança — trato como declaração de intenção — e deixo o bloqueio de verdade na borda, no CDN, onde a requisição morre antes de encostar no meu servidor. É a diferença entre pedir licença e ter porta.
E o volume é real, não é paranoia: a Cloudflare publicou, em agosto de 2025, a conta de quantas vezes cada empresa rastreia pra cada visitante que ela devolve — foram 38.065 rastreios por visitante no caso da Anthropic, 1.091 no da OpenAI e 5,4 no do Google, em julho daquele ano, com quase 80% da atividade de robô de IA sendo treino. Quem administra o servidor sente isso na conta de banda — e é exatamente essa dor que fez nascer o bloqueio que hoje deixa o seu site invisível. Quem opera infraestrutura de verdade sabe que a resposta está sempre no log, e foi assim que eu achei essa aqui.
Eu não trago isso como curiosidade. Trago porque mudou o lugar onde o cliente procura. Não é mais só "estar no Google": é o seu site, o da sua empresa, o do seu cliente ou o do seu SaaS aparecer quando a pessoa pergunta pra uma IA. Já escrevi aqui sobre o outro lado da mesma moeda — sem site, a IA não tem de onde tirar a sua empresa. Só que ter site e estar bloqueado dá no mesmo, com o agravante de você estar pagando por ele e achando que está resolvido.
E repare na ordem das coisas, porque é o que eu mais vejo errado: primeiro a pessoa escolhe o nome, e eu já contei por que nome e domínio vêm antes do site; depois faz o site; e aí para. Falta a última parte, que é a que dá dinheiro: fazer o site ser encontrado. É uma sacada simples, direta, que eu vi pouquíssimo lugar falando de forma prática — e que resolve em quinze minutos um problema que a pessoa arrasta há meses.
Este relato é da gravação de 22 de setembro de 2026, e a checagem da documentação eu fiz em 23 de setembro de 2026. Esse assunto está mudando rápido: o padrão de 2025 não é o mesmo de hoje, e o de 15 de setembro de 2026 já é outro. Não tome nada aqui como eterno — inclusive o nome dos menus, que essas empresas trocam sem avisar. Tome o método: pergunte pra IA, olhe o robots.txt, olhe o painel, olhe o log. Esse roteiro continua valendo quando o botão mudar de lugar.
TODA SEGUNDA · MEIO-DIA · AO VIVO
Discorda? Concorda? Tem um caso parecido? Aqui não tem caixa de comentário de propósito: segunda-feira, ao meio-dia, eu faço live no canal e a gente conversa sobre isso ao vivo — sem corte, como sempre.
Agora a parte que eu vendo, e eu prefiro avisar do que fingir que não é: esse tipo de detalhe é o que eu levo pra imersão de sites. Não é só o pipeline de produzir o site — é o fluxo completo, com as maldades de venda, suporte, indexação e SEO. Porque o que adianta fazer um site se não chega ninguém lá? Nada. É igual construir a sede da sua empresa, ou a do seu cliente, e botar no meio do nada, onde só o dono e os colaboradores vão ver. Absolutamente nada. Quem foi na primeira turma saiu com a cabeça explodida — teve gente falando que não conseguia pôr tudo no ar em trinta dias porque é muita coisa e pedindo uma comunidade pra explicar passo a passo; e teve quem já tinha um pouco mais de maldade e botou três sites no ar enquanto eu ainda estava falando. Os depoimentos estão aqui mesmo no site, e a conta de quanto isso fatura por mês eu já abri aqui no blog. Valor, data e condição ficam na página da imersão, que é onde essa informação é atualizada. E, de graça, o recado de hoje: arruma seu site aí, dá uma checada se não está bloqueado.
Baseado na gravação do canal @josimarjmv publicada em 22/09/2026 (6min23), com transcrição própria das legendas do próprio vídeo. São da minha vivência e foram ditos na gravação: ser dono de uma empresa de tecnologia, cuidar de venda, marketing e suporte, ser mão na massa em infraestrutura, hardware, rede, deploy, git e versionamento, com milhões de views por dia; ter perguntado a uma IA por TV indoor vertical e não aparecer dias antes, aparecendo depois; ter centenas de sites na Cloudflare, não ter ativado a opção manualmente na maioria deles, ter investigado log e concluído que a própria Cloudflare ativou nativamente; lembrar de três locais diferentes onde essa trava aparece; a origem do bloqueio estar na briga dos jornais contra raspagem de conteúdo; ter visto o mesmo problema em site de aluno e em site antigo meu enquanto preparava as aulas; ver rajadas de robô vindas da China no Google Analytics em épocas específicas do mês; e a leitura de que o site precisa ser encontrado, não só existir. É apuração minha, feita em 23/09/2026, e não estava na gravação: o anúncio de 1º de julho de 2025 da Cloudflare, com domínio novo começando bloqueado e a empresa cuidando de 20% da web; a reorganização de 15 de setembro de 2026 em Search, Training e Agent, os padrões novos por tipo de site, a migração automática de quem já tinha "Block AI Bots" e a opção "Disallow AI Training" honrada por Apple, Google e Microsoft; o caminho de menu Security Settings → Configure AI bot policies, do plano grátis pra cima; os nomes dos robôs de cada empresa e a declaração da Anthropic de que os três respeitam robots.txt; a frase da documentação de crawlers do Google de que o Google-Extended não impacta inclusão nem classificação na Busca; e os números de rastreio por visitante publicados pela Cloudflare em agosto de 2025. Ressalva de honestidade: a rajada vinda da China é observação minha no Analytics e eu não atribuo a nenhum robô específico, porque eu não apurei isso. E eu cito a minha imersão na gravação: como preço, data e condição são finais e mudam a cada turma, aqui eu não repito nenhum desses números e mando pra página da imersão.