Vai al contenuto
SEO Record
Choisir la langue : Italiano

Test gratuito · Assistenti IA

Il tuo sito è aperto alle IA?

ChatGPT, Claude, Perplexity, Copilot e Google citano solo ciò che possono leggere. Un robots.txt troppo ampio, un firewall configurato una volta e poi dimenticato, una pagina che esiste solo in JavaScript: la porta può chiudersi senza che nessuno lo sappia. Incolla il tuo indirizzo, ci pensiamo noi.

Leggiamo il tuo robots.txt, la tua home page come un browser, poi la stessa pagina a nome di otto robot di IA. Undici letture in tutto, dimenticate subito dopo. Leggiamo gli indirizzi pubblici, e solo quelli.

Cosa verifica il test e cosa dimostra

Tre letture, tre diverse forze probatorie. Il risultato indica sempre quale ha parlato.

  1. 1. Il tuo robots.txt — certo

    Il file è pubblico e la sua lettura è normata (RFC 9309). Lo leggiamo come lo leggono i robot: il gruppo che nomina il robot prevale sul gruppo generale, la regola più lunga vince e, a parità, prevale l'autorizzazione. Un robots.txt che risponde con un errore del server chiude l'intero sito a un robot rispettoso: noi lo segnaliamo.

  2. 2. La risposta data al robot — probabile

    Richiediamo la tua home page come farebbe un browser, poi a nome di GPTBot, ClaudeBot, PerplexityBot e degli altri. Se il browser riceve la pagina e il robot un rifiuto, un firewall sta filtrando i robot di IA. Diciamo «probabile» e non «certo»: il vero robot arriva dagli indirizzi del suo editore, e alcuni firewall lo trattano in modo diverso. Googlebot e Bingbot sono valutati solo sul robots.txt: i firewall bloccano per principio quelli falsi, e tu meriti un verdetto esatto.

  3. 3. Ciò che la pagina contiene così come viene servita

    I robot degli assistenti leggono la pagina così come arriva. Non eseguono il JavaScript. Una pagina costruita nel browser arriva loro quasi vuota: contiamo le parole effettivamente servite. Rileviamo anchenoindexenosnippet, che rimuovono la pagina dai motori su cui si appoggiano gli assistenti.

I robot, uno per uno

Ogni editore invia più robot, e ognuno ha il suo ruolo. I robot di ricerca decidono se puoi essere trovato, quindi citato. I robot di lettura su richiesta aprono la tua pagina quando un utente la fornisce all'assistente. I robot diaddestramento raccolgono dati per addestrare i modelli: chiuderli è una scelta legittima e ti mantiene in tutte le risposte.

RobotPerRuoloSe lo chiudi
OAI-SearchBotChatGPTRicercaLe tue pagine non compaiono più nelle risposte di ChatGPT con ricerca.
ChatGPT-UserChatGPTLettura su richiestaChatGPT non può più aprire la tua pagina quando un utente gliela chiede.
GPTBotOpenAIAddestramentoLe tue pagine non servono più ad addestrare i modelli. La ricerca resta intatta.
Claude-SearchBotClaudeRicercaLe tue pagine non compaiono più nelle risposte di Claude con ricerca.
Claude-UserClaudeLettura su richiestaClaude non può più aprire la tua pagina su richiesta di un utente.
ClaudeBotAnthropicAddestramentoLe tue pagine non servono più ad addestrare i modelli. La ricerca resta intatta.
PerplexityBotPerplexityRicercaLe tue pagine escono dall'indice di Perplexity.
Perplexity-UserPerplexityLettura su richiestaPerplexity non può più aprire la tua pagina su richiesta.
BingbotCopilotRicercaEsci da Bing — e da tutto ciò che si basa sul suo indice, Copilot compreso.
GooglebotGoogleRicercaEsci da Google, AI Overviews compresi.
Google-ExtendedGoogleAddestramentoGemini non usa più le tue pagine per addestrarsi. Google Search resta intatto.
MistralAI-UserLe ChatLettura su richiestaLe Chat di Mistral non può più aprire la tua pagina su richiesta.
CCBotCommon CrawlAddestramentoLe tue pagine escono dall'archivio aperto di cui si servono numerosi modelli.

Chiudere l'addestramento, restare nelle risposte

È la confusione più frequente: si vuole che i propri testi non addestrino i modelli, si chiudono «le IA» in blocco, e si esce anche dalle loro risposte. Le due cose si separano. Questo robots.txt chiude l'addestramento presso OpenAI, Anthropic, Google e Common Crawl, e lascia la ricerca aperta ovunque:

# Fermer l'entraînement, garder la recherche ouverte
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: CCBot
Disallow: /

# Tous les autres robots, dont ceux de la recherche
User-agent: *
Allow: /

Più righe User-agent di seguito formano un solo gruppo; un bot che ha il proprio gruppo ignora il gruppo *. Sottoponi il tuo sito al test dopo ogni modifica: una riga di troppo basta a chiudere la ricerca.

Il firewall: la porta che si chiude in silenzio

Un robots.txt si legge; un firewall, no. Cloudflare, alcune estensioni di sicurezza e alcuni hosting propongono di bloccare «i bot di IA» con un'unica impostazione. Questa impostazione risponde 403 ai bot e lascia robots.txt intatto: il sito appare aperto a chi legge il file, e chiuso a chi bussa alla porta. È esattamente ciò che la seconda lettura del test fa emergere.

Su Cloudflare, l'impostazione si trova nella dashboard del dominio, nella sezione dedicata ai bot di IA. Permette di trattare ogni bot separatamente: chiudere l'addestramento, mantenere la ricerca. Cloudflare può anche gestire il tuo robots.txt al posto tuo e scrivervi dei segnali di contenuto (Content-Signal: search=yes, ai-train=no); il test li legge e te li mostra.

Aperto, poi citato: due tappe

Una porta aperta è la condizione, non il risultato. Gli assistenti citano le pagine che trovano nei loro indici di ricerca, e vi trovano anzitutto le pagine già ben posizionate. Questo test dice se la via è libera; chi passa realmente da te si misura altrove.

Lo si misura al bordo della rete, là dove arrivano le richieste: quale bot ha letto quale pagina, e quando, ogni lettura certificata dagli intervalli di indirizzi che gli editori pubblicano. È ciò che fa GEO SEO Records. La guida Essere citati dagli assistenti IA spiega nel dettaglio cosa rende una pagina citabile una volta aperta la porta.

Da leggere dopo