Vai al contenuto
AI & GEO 6 min di lettura

AI e GEO: ottimizzare per la ricerca basata su intelligenza artificiale

Ciò di cui gli assistenti di ricerca IA hanno davvero bisogno da un sito — accesso dei crawler, indicizzazione e permesso di snippet —, quali crawler IA consentire in robots.txt, cosa fanno e non fanno llms.txt e i dati strutturati, e i dati del nostro studio su 4.645 siti dell’UE.

RP
Di RankProof
Team editoriale · RankProof

Risposta breve

Per comparire nelle risposte della ricerca con IA, una pagina deve prima poter essere scansionata e indicizzata dai sistemi di ricerca da cui attingono quelle risposte, e poter essere mostrata come snippet. Google dice che AI Overviews e la modalità IA non richiedono file o markup speciali; la ricerca di ChatGPT, Claude e Perplexity usano propri crawler, che robots.txt può consentire o bloccare. Oltre all’accesso, ciò che rende una pagina buona per la ricerca la rende citabile: una risposta chiara, fatti con fonti e testo leggibile da una macchina.

File speciali per le funzioni IA di Google
Nessuno
Impostazioni che limitano l’uso
noindex · nosnippet · max-snippet
Crawler di ricerca IA
OAI-SearchBot · Claude-SearchBot · PerplexityBot
Siti dell’UE che non bloccano alcun crawler IA
81,7% di 4.645
Siti dell’UE con un llms.txt valido
9,4%

AI e GEO: ottimizzare per la ricerca basata su intelligenza artificiale

Si chiama «generative engine optimisation» (GEO) il tentativo di farsi citare nelle risposte dell’IA: AI Overviews e modalità IA di Google, ricerca di ChatGPT, Claude, Perplexity, Copilot. Molto di ciò che si vende con questo nome non ha basi documentate. Questa guida separa ciò che gli operatori documentano da ciò che è supposizione, e riporta i dati del nostro studio sui siti dell’UE.

Cosa documentano davvero gli operatori

Google. La sua documentazione sulle funzioni IA dice che non ci sono requisiti aggiuntivi per comparire in AI Overviews o nella modalità IA, né ottimizzazioni speciali: la pagina deve essere indicizzata e idonea a comparire nella Ricerca con uno snippet. Valgono le consuete buone pratiche della Ricerca: consentire la scansione, collegare le pagine internamente, tenere il contenuto importante in testo, mantenere i dati strutturati coerenti con la pagina visibile. Non servono file di testo per l’IA né markup speciale.

OpenAI, Anthropic, Perplexity. Ognuno usa crawler diversi per scopi diversi, e ognuno dichiara che i suoi crawler rispettano robots.txt:

OperatoreCrawler di ricerca / risposteRecupero su richiesta di un utenteCrawler di addestramento
OpenAIOAI-SearchBotChatGPT-UserGPTBot
AnthropicClaude-SearchBotClaude-UserClaudeBot
PerplexityPerplexityBotPerplexity-User—
GoogleGooglebot (Ricerca, AI Overviews, modalità IA)—Google-Extended (token di controllo, non un crawler)

La distinzione importante: bloccare un crawler di addestramento non ti toglie dalla ricerca con IA, bloccare un crawler di ricerca sì. Se vuoi per esempio essere citato nella ricerca di ChatGPT, OAI-SearchBot deve essere consentito; GPTBot si può bloccare a parte. Google-Extended controlla se i contenuti sono usati per i modelli Gemini e non incide sulla presenza nella Ricerca Google. Copilot di Microsoft attinge all’indice di Bing, quindi lì conta l’accesso di Bingbot.

Passo 1: accesso

  1. robots.txt: consenti i crawler di ricerca e utente da cui vuoi essere citato. Le regole seguono la RFC 9309: si applica il gruppo corrispondente più specifico e vince il percorso corrispondente più lungo.
  2. Nessun blocco accidentale a livello di rete. La protezione dai bot può sfidare crawler che robots.txt consente; controlla nei log del firewall o della CDN le richieste bloccate dei crawler sopra.
  3. Indicizzazione: nessun noindex sulle pagine che vuoi vedere citate.
  4. Permesso di snippet: nosnippet, data-nosnippet e max-snippet limitano ciò che Google può mostrare, anche nelle funzioni IA. Usali consapevolmente, non come impostazione predefinita di un modello.

Cosa fanno oggi i siti dell’UE

A settembre 2026 abbiamo controllato robots.txt e /llms.txt di siti nazionali popolari in tutti i 27 paesi dell’UE — fino a 200 per paese, dall’elenco Chrome UX Report di agosto 2026. Dei 4.645 siti che abbiamo potuto misurare:

RisultatoQuota di siti
Non bloccano alcun crawler IA81,7%
Bloccano almeno un crawler di addestramento16,5%
Bloccano almeno un crawler IA di ricerca o utente10,1%
Bloccano tutti i crawler IA di ricerca e utente4,3%
Bloccano GPTBot13,8%
Bloccano OAI-SearchBot6,7%
Pubblicano un /llms.txt valido (su 4.260 controllati)9,4%

Due lezioni. La maggior parte dei siti non blocca nulla, quindi l’accesso è raramente il problema. E chi blocca, blocca più spesso i crawler di addestramento che quelli di ricerca, in linea con la distinzione sopra. Il nostro studio «Blocco dei crawler di IA sui siti dell’UE» riporta i dati per paese e per crawler, e il metodo.

Passo 2: meritare di essere citati

Le risposte IA citano pagine che rispondono chiaramente a una domanda e sono affidabili. Niente di tutto ciò è un fattore di posizionamento segreto; è ciò che chiedono comunque le indicazioni di Google sui contenuti utili:

  • Prima la risposta. Dai la risposta nelle prime righe, poi spiega. Chi scorre — persona o macchina — deve trovarla senza scorrere la pagina.
  • Una pagina, una domanda. Le pagine che mescolano più argomenti sono più difficili da citare.
  • Fatti con fonti. Numeri con data e link all’origine; fonti primarie anziché riassunti.
  • Tabelle ed elenchi per i dati che altrimenti resterebbero sepolti nel testo.
  • Informazioni originali. Le tue misurazioni, i tuoi esempi e la tua esperienza sono ciò che una risposta IA non trova altrove, e il motivo per citarti.
  • Autore e date chiari. Chi pubblica la pagina, come è stata prodotta e quando è cambiata l’ultima volta nella sostanza.

Cosa fanno — e non fanno — llms.txt e i dati strutturati

llms.txt è una proposta di file Markdown in /llms.txt che indica ai modelli linguistici le pagine principali di un sito. È rapido da pubblicare e innocuo, ma nessun grande operatore di ricerca IA documenta di leggerlo, e Google dice che non serve un file del genere. Consideralo facoltativo; solo il 9,4% dei siti dell’UE misurati ne ha uno valido.

I dati strutturati (JSON-LD con tipi schema.org) aiutano i motori di ricerca a capire le entità di una pagina — un’organizzazione, un prodotto, un articolo — e devono corrispondere al contenuto visibile. Da soli non portano una pagina nelle risposte IA.

Misurare

Non esiste un report completo delle citazioni IA. Ciò che puoi vedere: in Search Console i clic da AI Overviews e modalità IA sono conteggiati nel report Rendimento insieme ai risultati web; le visite da ChatGPT, Perplexity, Copilot e assistenti simili compaiono come referral nei tuoi analytics; e i log del server mostrano quali crawler IA hanno recuperato quali pagine. Diffida degli strumenti che promettono un «punteggio di visibilità IA» completo su tutti gli assistenti.

Verificare con RankProof

Il controllo di preparazione IA di RankProof valuta solo i segnali documentati dagli operatori: se i crawler IA di ricerca e utente (oltre a Googlebot e Bingbot) possono leggere la pagina, se è indicizzabile e se le impostazioni di snippet la bloccano. Gli extra facoltativi — llms.txt, una versione Markdown, dati strutturati — sono elencati ma non valutati. Il controllo robots.txt mostra quali crawler consentono le tue regole, il generatore robots.txt scrive regole per gruppo di crawler e il generatore llms.txt prepara il file se decidi di pubblicarne uno.

Pronto a posizionarti meglio?

Usa gli strumenti gratuiti di RankProof per migliorare i posizionamenti di ricerca e avvicinarti alla conformità UE sull'accessibilità.

Prova la scansione gratuita