Josimar JMV
Blog · Formação e carreira · 23·09·2026

Meu site estava invisível pro ChatGPT e eu não sabia

Peguei o ChatGPT e perguntei pelo que a minha empresa faz. Eu não aparecia. Não era texto ruim, não era falta de SEO: a opção de bloquear robô de inteligência artificial estava ligada — e ninguém do meu time tinha ligado. Eu tenho centenas de domínios nesse painel. Fui investigar log pra entender de onde saía aquilo.

Resposta rápida: se o seu site não aparece quando alguém pergunta pro ChatGPT, a primeira coisa a checar não é o conteúdo — é se o robô consegue entrar. Existe uma chave no painel do CDN que bloqueia os robôs de IA (o do ChatGPT, o do Claude, o do Gemini) e ela vem ligada por padrão em domínio novo desde 1º de julho de 2025, por decisão pública da Cloudflare. Em 15 de setembro de 2026 os padrões mudaram de novo e agora o robô é separado por comportamento — busca, treino e agente, o que permite recusar treino sem sumir da busca. Vá em Security Settings → Configure AI bot policies, olhe também o robots.txt e as regras de bot (é em mais de um lugar, por isso confunde) e libere os robôs de busca: OAI-SearchBot, Claude-SearchBot, Googlebot. Leva quinze minutos e não custa nada.

Gravei esses 6 minutos no canal @josimarjmv em 22 de setembro de 2026, sem edição, do jeito que eu gravo: essa câmera e essa câmera. Assista e leia junto — aqui embaixo eu conto a mesma coisa com calma e com o que eu fui conferir depois, na documentação de cada empresa, com data.

🎧 PREFERE OUVIR? · 6 min

Este artigo também é um episódio do podcast Josimar JMV | Em Produção — o mesmo vídeo, só o áudio, normalizado pra fone.

Baixar MP3 · RSS · todos os episódios

A carteirada primeiro: eu administro esses domínios, não comento sobre eles

Vou dar a minha carteirada antes, senão isso aqui vira mais um texto de gente repetindo dica de SEO que leu em outro lugar. Eu tenho uma empresa de tecnologia e sou dono mesmo — não é aquele "sou CEO" de perfil bonito. Eu cuido de venda, de marketing e de suporte, e eu sou mão na massa: gerencio infraestrutura, hardware de verdade, a parte de rede, lógica, deploy, git, versionamento. São milhões de views todos os dias que eu ponho a mão pra cuidar e arquitetar.

Digo isso por um motivo prático: o que eu vou contar aqui eu não li. Eu tropecei nele dentro da minha própria operação, com centenas de domínios num painel só, e fui atrás do log até achar. E, quando eu fui preparar as aulas da minha imersão de sites, vi a mesma coisa no site de aluno e até num site antigo meu. Não é caso isolado — é um monte de gente com o site no ar, bonito, funcionando, e invisível pras inteligências artificiais, sem fazer a menor ideia do porquê.

O caso: eu perguntei, eu não estava lá — e hoje eu estou

Deixa eu contar do jeito que aconteceu. Você abre o ChatGPT e pergunta o que qualquer cliente seu perguntaria: "qual a melhor clínica", "qual o melhor isso", "qual o melhor aquilo". Eu fiz isso com o que eu vendo. Perguntei por TV indoor vertical.

Pergunta aí agora que eu já estou lá. Mas eu não estava dias atrás. E a diferença entre não estar e estar não foi artigo novo, não foi backlink, não foi palavra-chave: foi uma chave desligada no painel. Esse é o tamanho da bobagem — e é justamente por ser bobagem que ninguém procura ali.

Quem trabalha com site sabe a sensação: você mexe no site, publica, faz aquele tanto de coisa, manda pergunta e não aparece. Manda de novo, não aparece. E você não entende. Fica achando que é o algoritmo, que é concorrência, que é sorte. Não é nada disso. O robô nem chegou a ler a sua página.

De onde vem esse bloqueio (e por que não fomos nós que ligamos)

A primeira coisa que eu quis entender foi a origem. A gente tem centenas de sites na Cloudflare e, em muitos deles, nós não colocamos essa opção manualmente. A gente investigou log e tudo. A conclusão foi essa: a própria Cloudflare ativou nativamente.

E o motivo, na origem, faz sentido. Sabe os jornais grandes do Brasil? Folha, esse pessoal todo. Eles não querem que fiquem fazendo scrap do conteúdo deles — raspar, catar o texto da página e jogar num portal automatizado. É uma briga legítima e antiga. O problema é que a solução que nasceu pra proteger jornal virou padrão pra todo mundo, inclusive pro seu site de cinco páginas que só queria ser encontrado.

Apuração minha (23/09/2026), porque na gravação eu falei isso de cabeça: não é impressão, é anunciado. Em 1º de julho de 2025, no que chamou de Content Independence Day, a Cloudflare anunciou que todo domínio novo passaria a começar bloqueando os robôs de IA — a empresa cuida do tráfego de cerca de 20% da web, então isso não é detalhe de nicho, é uma fatia enorme da internet mudando de comportamento de uma vez.

E mudou de novo, uma semana antes de eu gravar: em 15 de setembro de 2026 a Cloudflare reorganizou os robôs por comportamentoSearch (indexar pra responder depois), Training (treinar ou afinar modelo) e Agent (agente abrindo a página em nome de uma pessoa, na hora). O padrão novo de domínio com anúncio ficou: busca liberada, treino recusado, agente bloqueado nas páginas com anúncio. Sem anúncio, tudo liberado. Quem já tinha configuração antiga foi migrado: o velho "Block AI Bots" virou "Disallow AI Training".

Onde exatamente mexer — e por que parece que está em três lugares

Na gravação eu disse que, se eu não me engano, são três locais diferentes onde essa trava aparece. Fui conferir com calma pra te dar o caminho certo em vez de te deixar procurando.

O caminho oficial hoje é Security Settings → Configure AI bot policies, e está disponível do plano grátis pra cima (documentação da Cloudflare). A sensação de "está em três lugares" tem fundamento: o mesmo efeito de bloqueio aparece também no robots.txt gerenciado e nas regras de bot. Então o roteiro é esse, e nessa ordem:

Desligar num lugar e esquecer do outro é o erro mais comum — e é o que faz a pessoa jurar que liberou e continuar sem aparecer. Confira os três.

O CAMINHO DO ROBÔ ATÉ A SUA PÁGINA três portas em série — basta UMA fechada pra você ficar invisível O ROBÔ DE BUSCA DE IA BATE NA PORTA OAI-SearchBot (ChatGPT) · Claude-SearchBot · Googlebot 1 · POLÍTICA DE ROBÔ DE IA Security Settings → Configure AI bot policies Search · Training · Agent mora aqui o estrago maior 2 · ROBOTS.TXT GPTBot · ClaudeBot Google-Extended Disallow: / aqui = invisível 3 · REGRAS DE BOT firewall / WAF regra velha anti-scraper pega robô de IA junto ninguém lembra dela A SUA PÁGINA — só é lida se os TRÊS estiverem liberados domínio novo na Cloudflare já nasce bloqueado desde 01/07/2025 · padrões mudaram de novo em 15/09/2026

Os nomes dos robôs: não é um só por empresa

Aqui entra a parte que eu fui conferir depois de gravar, porque eu falei "o bot da OpenAI, o bot do Claude, o bot do Gemini" e na prática cada empresa tem mais de um robô, com funções diferentes. E isso muda tudo, porque você pode querer um e não querer o outro:

Se o que você quer é aparecer na resposta — e é isso que traz cliente —, quem tem que estar liberado é o robô de busca: OAI-SearchBot, Claude-SearchBot, Googlebot. Bloquear tudo de uma vez pra "proteger o conteúdo" é jogar fora justamente a parte que te dá visibilidade.

Recusar treino sem sumir da busca — isso mudou este mês

Tem gente que não quer aparecer por ideologia, e eu respeito: é o seu conteúdo, você decide. Mas até pouco tempo a decisão era tudo ou nada, e muita gente se bloqueou inteira sem querer.

Hoje não é mais assim. A opção Disallow AI Training que entrou em 15 de setembro publica a recusa de treino mantendo a indexação pra busca — e, segundo a própria Cloudflare, Apple, Google e Microsoft honram ou se comprometeram a honrar essa preferência. Do lado do Google a regra já era essa e está escrita na documentação de crawlers: "Google-Extended does not impact a site's inclusion in Google Search nor is it used as a ranking signal in Google Search". Traduzindo pro nosso lado: bloquear o Google-Extended não tira você do Google. Tira você do treino do Gemini. São chaves diferentes, e confundir as duas é o que mais dá prejuízo.

A rajada da China que aparece no Analytics

Uma curiosidade que eu queria dividir, porque é assustadora quando você vê pela primeira vez. Eu tenho o Google Analytics integrado e, de vez em quando, eu fico olhando: tem época do mês específica em que os robôs chineses invadem todos os sites e validam tudo de novo. Você abre o relatório e vê uma rajada de visita vinda da China. Faça o teste no seu e me conta no comentário do vídeo se acontece igual.

Aqui vale a minha nota de honestidade: eu não sei de quem é e não vou chutar nome. O que eu sei, e isso é o que interessa pro seu dia a dia, é que o robots.txt é pedido, não é muro. Quem respeita, respeita. Quem não respeita, entra do mesmo jeito. Por isso eu não trato robots.txt como segurança — trato como declaração de intenção — e deixo o bloqueio de verdade na borda, no CDN, onde a requisição morre antes de encostar no meu servidor. É a diferença entre pedir licença e ter porta.

E o volume é real, não é paranoia: a Cloudflare publicou, em agosto de 2025, a conta de quantas vezes cada empresa rastreia pra cada visitante que ela devolve — foram 38.065 rastreios por visitante no caso da Anthropic, 1.091 no da OpenAI e 5,4 no do Google, em julho daquele ano, com quase 80% da atividade de robô de IA sendo treino. Quem administra o servidor sente isso na conta de banda — e é exatamente essa dor que fez nascer o bloqueio que hoje deixa o seu site invisível. Quem opera infraestrutura de verdade sabe que a resposta está sempre no log, e foi assim que eu achei essa aqui.

Por que isso deixou de ser detalhe técnico

Eu não trago isso como curiosidade. Trago porque mudou o lugar onde o cliente procura. Não é mais só "estar no Google": é o seu site, o da sua empresa, o do seu cliente ou o do seu SaaS aparecer quando a pessoa pergunta pra uma IA. Já escrevi aqui sobre o outro lado da mesma moeda — sem site, a IA não tem de onde tirar a sua empresa. Só que ter site e estar bloqueado dá no mesmo, com o agravante de você estar pagando por ele e achando que está resolvido.

E repare na ordem das coisas, porque é o que eu mais vejo errado: primeiro a pessoa escolhe o nome, e eu já contei por que nome e domínio vêm antes do site; depois faz o site; e aí para. Falta a última parte, que é a que dá dinheiro: fazer o site ser encontrado. É uma sacada simples, direta, que eu vi pouquíssimo lugar falando de forma prática — e que resolve em quinze minutos um problema que a pessoa arrasta há meses.

Nota de cronologia (importante)

Este relato é da gravação de 22 de setembro de 2026, e a checagem da documentação eu fiz em 23 de setembro de 2026. Esse assunto está mudando rápido: o padrão de 2025 não é o mesmo de hoje, e o de 15 de setembro de 2026 já é outro. Não tome nada aqui como eterno — inclusive o nome dos menus, que essas empresas trocam sem avisar. Tome o método: pergunte pra IA, olhe o robots.txt, olhe o painel, olhe o log. Esse roteiro continua valendo quando o botão mudar de lugar.

TODA SEGUNDA · MEIO-DIA · AO VIVO

Discorda? Concorda? Tem um caso parecido? Aqui não tem caixa de comentário de propósito: segunda-feira, ao meio-dia, eu faço live no canal e a gente conversa sobre isso ao vivo — sem corte, como sempre.

Ver as lives no canal @josimarjmv →

Perguntas frequentes

Por que o meu site não aparece nas respostas do ChatGPT?
Antes de culpar o conteúdo, veja se o robô consegue entrar. Na minha operação, com centenas de domínios, eu achei a opção de bloqueio de robô de inteligência artificial ativada no painel sem ninguém do meu time ter ativado. Com essa chave ligada, o robô do ChatGPT, o do Claude e o do Gemini batem na porta e tomam bloqueio antes de ler qualquer linha. Você pode escrever o melhor texto do mundo que ele não vai ser lido. Primeiro abre a porta, depois discute conteúdo.
Onde fica a opção de bloquear robôs de IA na Cloudflare?
Na documentação oficial de hoje, 23 de setembro de 2026, o caminho é Security Settings e depois Configure AI bot policies, disponível do plano grátis pra cima. Eu falei na gravação que lembrava de três lugares diferentes, e é por isso que confunde: além dessa chave, o mesmo efeito aparece no robots.txt gerenciado e nas regras de bot. Confira os três antes de dizer que está liberado, porque desligar num lugar e esquecer do outro é o erro mais comum.
A Cloudflare bloqueia bot de IA por padrão?
Em domínio novo, sim, e isso é público. Em 1º de julho de 2025 a Cloudflare anunciou que todo domínio novo passaria a começar bloqueando os robôs de inteligência artificial, no que ela chamou de Content Independence Day. Em 15 de setembro de 2026 ela reorganizou isso em três categorias, Search, Training e Agent, e o padrão de domínio novo com anúncio virou: busca liberada, treino recusado e agente bloqueado nas páginas com anúncio. Ou seja, o bloqueio que eu achei não é fantasma, é padrão do setor.
Bloquear o Google-Extended tira o meu site do Google?
Não, e essa é a parte que quase todo mundo erra. A documentação do Google diz com todas as letras que o Google-Extended não impacta a inclusão do site na Busca nem é usado como sinal de classificação. Ele controla só se o seu conteúdo ajuda a treinar os modelos Gemini. Quem manda na Busca é o Googlebot. São chaves diferentes, e tratar as duas como a mesma coisa é o que faz gente sumir da IA sem precisar ou continuar no treino sem querer.
Dá pra recusar treino de IA e continuar aparecendo na busca?
Hoje dá, e é novidade recente. Em 15 de setembro de 2026 a Cloudflare separou o robô por comportamento e criou a opção Disallow AI Training, que publica a recusa de treino mantendo a indexação pra busca. Apple, Google e Microsoft honram ou se comprometeram a honrar essa preferência. Antes disso era tudo ou nada, e era por isso que muita gente se bloqueava inteira sem perceber o tamanho do estrago.
Quais são os nomes dos robôs de IA que eu preciso liberar?
Cada empresa tem mais de um, com finalidades diferentes. Na OpenAI: GPTBot pra treino, OAI-SearchBot pra busca do ChatGPT e ChatGPT-User quando o usuário manda abrir um endereço. Na Anthropic: ClaudeBot pra treino, Claude-SearchBot pra busca e Claude-User pro pedido do usuário, e a empresa diz que os três respeitam o robots.txt. No Google: Googlebot pra Busca e Google-Extended pro treino do Gemini. Quem quer aparecer na resposta e não no treino libera os de busca e recusa os de treino.
O robots.txt sozinho resolve?
Resolve pra quem obedece. O robots.txt é pedido, não é muro: quem respeita, respeita; quem não respeita, entra. Por isso eu não trato o arquivo como segurança, eu trato como declaração de intenção, e deixo o bloqueio de verdade na borda, no CDN, onde a requisição morre antes de chegar no meu servidor. É a mesma lógica de sempre: uma coisa é o que você pede, outra é o que você consegue impor.
Como eu descubro se o meu site está bloqueado agora?
Faça o que eu fiz. Pergunte pra uma inteligência artificial sobre o que você vende e veja se você aparece. Depois abra o robots.txt do seu domínio no navegador e procure por GPTBot, ClaudeBot e Google-Extended. Depois entre no painel do seu CDN e olhe as políticas de robô de IA. Por último, olhe o log e o Analytics: se os robôs de busca de IA nunca aparecem, é porque nunca chegaram. Leva quinze minutos e é a coisa mais barata que você vai fazer pelo seu site esse mês.

Agora a parte que eu vendo, e eu prefiro avisar do que fingir que não é: esse tipo de detalhe é o que eu levo pra imersão de sites. Não é só o pipeline de produzir o site — é o fluxo completo, com as maldades de venda, suporte, indexação e SEO. Porque o que adianta fazer um site se não chega ninguém lá? Nada. É igual construir a sede da sua empresa, ou a do seu cliente, e botar no meio do nada, onde só o dono e os colaboradores vão ver. Absolutamente nada. Quem foi na primeira turma saiu com a cabeça explodida — teve gente falando que não conseguia pôr tudo no ar em trinta dias porque é muita coisa e pedindo uma comunidade pra explicar passo a passo; e teve quem já tinha um pouco mais de maldade e botou três sites no ar enquanto eu ainda estava falando. Os depoimentos estão aqui mesmo no site, e a conta de quanto isso fatura por mês eu já abri aqui no blog. Valor, data e condição ficam na página da imersão, que é onde essa informação é atualizada. E, de graça, o recado de hoje: arruma seu site aí, dá uma checada se não está bloqueado.

Baseado na gravação do canal @josimarjmv publicada em 22/09/2026 (6min23), com transcrição própria das legendas do próprio vídeo. São da minha vivência e foram ditos na gravação: ser dono de uma empresa de tecnologia, cuidar de venda, marketing e suporte, ser mão na massa em infraestrutura, hardware, rede, deploy, git e versionamento, com milhões de views por dia; ter perguntado a uma IA por TV indoor vertical e não aparecer dias antes, aparecendo depois; ter centenas de sites na Cloudflare, não ter ativado a opção manualmente na maioria deles, ter investigado log e concluído que a própria Cloudflare ativou nativamente; lembrar de três locais diferentes onde essa trava aparece; a origem do bloqueio estar na briga dos jornais contra raspagem de conteúdo; ter visto o mesmo problema em site de aluno e em site antigo meu enquanto preparava as aulas; ver rajadas de robô vindas da China no Google Analytics em épocas específicas do mês; e a leitura de que o site precisa ser encontrado, não só existir. É apuração minha, feita em 23/09/2026, e não estava na gravação: o anúncio de 1º de julho de 2025 da Cloudflare, com domínio novo começando bloqueado e a empresa cuidando de 20% da web; a reorganização de 15 de setembro de 2026 em Search, Training e Agent, os padrões novos por tipo de site, a migração automática de quem já tinha "Block AI Bots" e a opção "Disallow AI Training" honrada por Apple, Google e Microsoft; o caminho de menu Security Settings → Configure AI bot policies, do plano grátis pra cima; os nomes dos robôs de cada empresa e a declaração da Anthropic de que os três respeitam robots.txt; a frase da documentação de crawlers do Google de que o Google-Extended não impacta inclusão nem classificação na Busca; e os números de rastreio por visitante publicados pela Cloudflare em agosto de 2025. Ressalva de honestidade: a rajada vinda da China é observação minha no Analytics e eu não atribuo a nenhum robô específico, porque eu não apurei isso. E eu cito a minha imersão na gravação: como preço, data e condição são finais e mudam a cada turma, aqui eu não repito nenhum desses números e mando pra página da imersão.