Teste gratuito · Assistentes de IA
O seu site está aberto às IA?
O ChatGPT, o Claude, o Perplexity, o Copilot e o Google só citam aquilo que conseguem ler. Um robots.txt demasiado abrangente, uma firewall configurada uma vez e depois esquecida, uma página que só existe em JavaScript: a porta pode fechar-se sem que ninguém se dê conta. Cole o seu endereço, nós verificamos.
Lemos o seu robots.txt, a sua página inicial como um navegador e depois a mesma página em nome de oito robôs de IA. Onze leituras no total, esquecidas logo após serem feitas. Lemos os endereços públicos, e apenas esses.
O que o teste verifica e o que prova
Três leituras, três forças de prova diferentes. O resultado diz sempre qual delas falou.
1. O seu robots.txt — certo
O ficheiro é público e a sua leitura é normalizada (RFC 9309). Lemo-lo como os robôs o leem: o grupo que nomeia o robô prevalece sobre o grupo geral, a regra mais longa ganha e, em caso de igualdade, prevalece a autorização. Um robots.txt que responde com erro de servidor fecha todo o site a um robô que o respeite: nós assinalamo-lo.
2. A resposta dada ao robô — provável
Pedimos a sua página inicial como um navegador e depois em nome do GPTBot, do ClaudeBot, do PerplexityBot e dos outros. Se o navegador recebe a página e o robô recebe uma recusa, há uma firewall a filtrar os robôs de IA. Dizemos «provável» e não «certo»: o verdadeiro robô chega dos endereços do seu editor, e algumas firewalls tratam-no de outra forma. O Googlebot e o Bingbot são avaliados apenas pelo robots.txt: as firewalls bloqueiam os falsos por princípio, e você merece um veredicto exato.
3. O que a página contém tal como é servida
Os robôs dos assistentes leem a página tal como ela chega. Não executam o JavaScript. Uma página construída no navegador chega-lhes praticamente vazia: contamos as palavras realmente servidas. Verificamos também
noindexenosnippet, que retiram a página dos motores em que os assistentes se baseiam.
Os robôs, um a um
Cada editor envia vários robôs, e cada um tem a sua função. Os robôs de pesquisa decidem se pode ser encontrado e, portanto, citado. Os robôs de leitura a pedido abrem a sua página quando um utilizador a fornece ao assistente. Os robôs detreino recolhem dados para treinar os modelos: fechá-los é uma escolha legítima e mantém-no em todas as respostas.
| Robô | Para | Função | Se o fechar |
|---|---|---|---|
| OAI-SearchBot | ChatGPT | Pesquisa | As suas páginas deixam de aparecer nas respostas do ChatGPT com pesquisa. |
| ChatGPT-User | ChatGPT | Leitura a pedido | O ChatGPT deixa de poder abrir a sua página quando um utilizador o solicita. |
| GPTBot | OpenAI | Treino | As suas páginas deixam de servir para treinar os modelos. A pesquisa mantém-se intacta. |
| Claude-SearchBot | Claude | Pesquisa | As suas páginas deixam de aparecer nas respostas do Claude com pesquisa. |
| Claude-User | Claude | Leitura a pedido | O Claude deixa de poder abrir a sua página a pedido de um utilizador. |
| ClaudeBot | Anthropic | Treino | As suas páginas deixam de servir para treinar os modelos. A pesquisa mantém-se intacta. |
| PerplexityBot | Perplexity | Pesquisa | As suas páginas saem do índice da Perplexity. |
| Perplexity-User | Perplexity | Leitura a pedido | A Perplexity deixa de poder abrir a sua página a pedido. |
| Bingbot | Copilot | Pesquisa | Sai do Bing — e de tudo o que assenta no seu índice, incluindo o Copilot. |
| Googlebot | Pesquisa | Sai do Google, incluindo as AI Overviews. | |
| Google-Extended | Treino | O Gemini já não utiliza as suas páginas para se treinar. A Pesquisa Google permanece intacta. | |
| MistralAI-User | Le Chat | Leitura a pedido | O Chat da Mistral já não consegue abrir a sua página quando solicitado. |
| CCBot | Common Crawl | Treino | As suas páginas saem do arquivo aberto de que muitos modelos se servem. |
Fechar o treino, permanecer nas respostas
É a confusão mais frequente: quer-se que os seus textos não treinem os modelos, fecha-se «as IA» em bloco e sai-se também das suas respostas. As duas coisas separam-se. Este robots.txt fecha o treino na OpenAI, na Anthropic, na Google e na Common Crawl, e deixa a pesquisa aberta em todas elas:
# Fermer l'entraînement, garder la recherche ouverte
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: CCBot
Disallow: /
# Tous les autres robots, dont ceux de la recherche
User-agent: *
Allow: /Várias linhas User-agent seguidas formam um único grupo; um robô que tem o seu próprio grupo ignora o grupo *. Submeta o seu site ao teste após cada alteração: uma linha a mais basta para fechar a pesquisa.
A firewall: a porta que se fecha em silêncio
Um robots.txt lê-se; uma firewall, não. A Cloudflare, algumas extensões de segurança e certos alojamentos propõem bloquear «os robôs de IA» com um único ajuste. Esse ajuste responde 403 aos robôs e deixa o robots.txt intacto: o site parece aberto a quem lê o ficheiro e fechado a quem bate à porta. É exatamente isso que a segunda leitura do teste faz aparecer.
Na Cloudflare, o ajuste encontra-se no painel do domínio, na secção dedicada aos robôs de IA. Permite tratar cada robô separadamente: fechar o treino, manter a pesquisa. A Cloudflare pode também gerir o seu robots.txt por si e escrever nele sinais de conteúdo (Content-Signal: search=yes, ai-train=no); o teste lê-os e mostra-os.
Aberto e depois citado: duas etapas
Uma porta aberta é a condição, não o resultado. Os assistentes citam as páginas que encontram nos seus índices de pesquisa, e aí encontram primeiro as páginas já bem posicionadas. Este teste diz se o caminho está livre; quem passa realmente no seu site mede-se noutro lugar.
Isto mede-se na periferia da rede, onde os pedidos chegam: que robô leu que página, e quando, cada leitura certificada pelas gamas de endereços que os editores publicam. É isso que faz o GEO SEO Records. O guia Ser citado pelos assistentes de IA detalha o que torna uma página citável depois de a porta estar aberta.