Se il tuo sito non compare nelle risposte di ChatGPT, la causa è quasi sempre una di queste quattro, in ordine di probabilità: il robots.txt blocca OAI-SearchBot, le pagine mostrano i contenuti solo dopo l'esecuzione del JavaScript, gli URL che il crawler prova non rispondono, oppure nella pagina non c'è una risposta alla domanda. Le prime tre sono tecniche e si chiudono in pochi giorni.
Conviene affrontarle in quest'ordine e fermarsi alla prima che vale per il tuo sito: lavorare sui contenuti mentre il crawler è bloccato non produce nessun effetto.
Punti chiave
- Escludere OAI-SearchBot dal robots.txt significa uscire dalle risposte di ricerca di ChatGPT, e OpenAI lo dichiara in modo esplicito.
- Bloccare GPTBot riguarda l'addestramento, non la ricerca: sono due user agent distinti e vanno decisi separatamente.
- I crawler AI di OpenAI, Anthropic e Perplexity non eseguono JavaScript, quindi una pagina renderizzata lato client per loro è un documento vuoto.
- Su ChatGPT non c'è una posizione da scalare: la misura sensata è un tasso di menzione su prompt ripetuti, non un ranking.
Che cosa vuol dire "non compaio su ChatGPT"?
Dietro la stessa frase si nascondono due problemi diversi, e le cure non si somigliano.
- ChatGPT non mostra mai le tue pagine. Fai una domanda a cui la tua pagina risponde quasi parola per parola, ChatGPT cerca sul web e cita altri tre siti. È un problema di recuperabilità, ed è tecnico.
- ChatGPT conosce la categoria ma non il tuo brand. Chiedi "qual è il miglior X per Y" e nella risposta ci sono i competitor. È un problema di visibilità, e si muove su tempi più lunghi.
Chiudi prima il primo, perché blocca il secondo: una pagina che ChatGPT non riesce a scaricare o a leggere non viene citata, per quanto sia buona. Il meccanismo che sta dietro a entrambi è in Come i modelli AI scelgono quali brand citare.
Su ChatGPT esiste un posizionamento?
No, ed è la prima cosa da disinnescare. "Posizionamento su ChatGPT" è una comodità di linguaggio presa in prestito da Google: non c'è una pagina di risultati con dieci posizioni, quindi non c'è una posizione da conquistare. ChatGPT compone una risposta e, dentro quella risposta, il tuo brand viene nominato oppure no.
Cambia anche la metrica: non la posizione media di una keyword, ma la quota di volte in cui compari su un insieme fisso di domande, quello che il settore chiama tasso di menzione. Lo stesso prompt, lo stesso modello e lo stesso giorno possono nominarti una volta e ignorarti quella dopo, e il passaggio da un ranking stabile a un tasso campionato è il cuore di GEO vs SEO.
Quindi "come apparire su ChatGPT" si scompone in due lavori: essere recuperabile (cause 1, 2 e 3) ed essere citabile (causa 4). La seconda metà è quella che il settore chiama GEO, Generative Engine Optimization, o AEO quando si parla di ottimizzazione per i motori di risposta.
Causa 1: il robots.txt sta bloccando il bot sbagliato?
È la causa più frequente e la più rapida da sistemare. OpenAI usa più crawler con compiti diversi, e bloccarli costa cose diverse:
| User agent | A che serve | Cosa costa bloccarlo |
|---|---|---|
| OAI-SearchBot | Mostra i siti nelle funzioni di ricerca di ChatGPT | Il sito non compare nelle risposte di ricerca di ChatGPT |
| ChatGPT-User | Recupera una pagina per un'azione chiesta da una persona | Una pagina richiesta esplicitamente può non essere letta |
| GPTBot | Raccoglie contenuti per i modelli generativi di OpenAI | I tuoi contenuti non vengono usati per l'addestramento |
La colonna centrale riprende la descrizione che OpenAI dà di ciascun bot, e la prima riga è quella che quasi tutti sbagliano: OpenAI scrive che i siti che escludono OAI-SearchBot non vengono mostrati nelle risposte di ricerca di ChatGPT, anche se possono restare come link di navigazione (OpenAI). Due errori fanno quasi tutto il danno:
- Lo snippet "blocca i bot AI" copiato da un blog. Molti snippet in circolazione mettono un
Disallowsu tutti gli user agent AI insieme, e lo stesso fanno le opzioni "blocca AI" di alcuni plugin. Rifiutare l'addestramento è una scelta legittima, ma se in quella lista c'è OAI-SearchBot hai anche rinunciato alle risposte di ChatGPT, mentre i tuoi competitor ci restano. - La regola di staging finita in produzione.
User-agent: *conDisallow: /blocca anche OAI-SearchBot. Leggi il/robots.txtpubblicato sul dominio di produzione, non la copia nel repository.
Le richieste avviate da una persona sono un caso a parte, e i provider non si comportano allo stesso modo. OpenAI segnala che le regole del robots.txt possono non applicarsi a ChatGPT-User, perché la richiesta nasce da un'azione dell'utente. Anthropic dichiara che i suoi tre bot (ClaudeBot per l'addestramento, Claude-SearchBot per la qualità della ricerca, Claude-User per le richieste degli utenti) rispettano le direttive del robots.txt (Anthropic). Perplexity documenta che PerplexityBot va ammesso nel robots.txt per comparire nei suoi risultati, mentre Perplexity-User in genere ignora quelle regole (Perplexity). Non c'è un interruttore unico per "l'AI", ed essere visibile su un assistente non ti porta dentro gli altri.
Causa 2: le pagine hanno bisogno di JavaScript per mostrare i contenuti?
Se i testi arrivano con il rendering lato client, il crawler di ChatGPT riceve un guscio vuoto. In un'analisi del traffico dei crawler AI sulla propria rete, pubblicata a dicembre 2024, Vercel e MERJ hanno osservato che nessuno dei principali crawler AI di OpenAI, Anthropic e Perplexity esegue JavaScript, su circa 960 milioni di richieste registrate in un mese da GPTBot, dai crawler di Claude e da PerplexityBot: il crawler di ChatGPT scaricava file JavaScript nell'11,5% delle richieste e quello di Claude nel 23,8%, senza eseguirli (Vercel e MERJ). Nello stesso studio Gemini, che poggia sull'infrastruttura di Googlebot, risulta invece capace di renderizzare la pagina.
È questa differenza che tiene nascosta la causa per mesi: Google dichiara di essere in grado di elaborare i contenuti prodotti da JavaScript, a condizione che gli script non siano bloccati (Google Search Central). Un sito può posizionarsi in modo dignitoso su Google ed essere una pagina bianca per ChatGPT. Il caso tipico è il sito vetrina costruito come single page application, o con un builder che carica i testi dopo il primo HTML.
La verifica è un comando: scarica la pagina come farebbe un crawler, con curl -s https://tuodominio.it/tua-pagina, e cerca nell'HTML grezzo la frase che vorresti vedere citata. Se non c'è lì, non è nemmeno nella copia della tua pagina che ChatGPT legge. La soluzione è il rendering lato server o il prerender di tutte le pagine pubbliche, non un accorgimento sui contenuti.
Causa 3: ChatGPT riesce ad arrivare all'URL?
Ci sono pagine ammesse e leggibili che si perdono comunque per strada. Nella stessa misurazione, circa il 35% delle richieste del crawler di ChatGPT finiva su pagine 404 e un altro 14% seguiva redirect, quindi una quota consistente del lavoro di crawling non arriva mai a un contenuto vivo. La manutenzione, poco glamour, conta più di quanto sembri:
- tieni stabili gli URL e, quando uno deve cambiare, usa un singolo redirect permanente invece di una catena;
- correggi i link interni che puntano a pagine morte, perché i crawler scoprono gli URL dal tuo stesso HTML;
- tieni aggiornata la sitemap, con ogni URL che risponde 200 e mostra il suo contenuto reale;
- restituisci un 404 vero per le pagine che non esistono, invece di un soft 404 che risponde 200 con un template vuoto;
- controlla che banner di consenso, redirect per paese e sistemi antibot non si mettano tra il crawler e il testo: se i contenuti compaiono solo dopo l'accettazione del banner, per un crawler la pagina è vuota.
Causa 4: nella pagina c'è una risposta alla domanda?
Se le prime tre cause sono a posto e continui a non comparire, il problema è il contenuto. ChatGPT compone una risposta e riprende ciò che è facile da prelevare. Le pagine che vincono hanno una risposta autosufficiente di due o tre frasi all'inizio di ogni sezione, titoli scritti come le domande che le persone digitano davvero, e dati concreti (definizioni, numeri, date) dove la maggior parte dei siti mette aggettivi. Serve anche la lingua giusta: se i tuoi clienti chiedono in italiano, la risposta deve esistere in italiano sul tuo sito.
Questo pezzo di lavoro è misurabile, non folklore. Il paper di ricerca che ha dato il nome alla GEO ha riscritto le pagine con interventi di questo tipo e ha misurato fino al 40% di visibilità in più nelle risposte dei motori generativi sul proprio benchmark, con un'efficacia che varia per dominio (Aggarwal et al., KDD 2024). I pattern sono raccolti in Cos'è la GEO: guida pratica.
Il file llms.txt serve per farsi citare da ChatGPT?
Nella documentazione dei provider non c'è niente che lo dica. llms.txt è una convenzione opzionale: un file di testo che descrive il tuo sito ai sistemi AI. Google ha chiarito che la Ricerca non usa questi file e che pubblicarli non aiuta né danneggia visibilità e ranking, e che per le sue funzioni generative non serve nessun file leggibile dalle macchine né uno schema speciale, perché quelle funzioni poggiano sugli stessi sistemi di ranking e qualità della Ricerca (Google Search Central). OpenAI e Anthropic documentano il robots.txt per gestire i loro crawler, non llms.txt. Pubblicalo se uno strumento che usi lo consuma, e dopo aver chiuso le quattro cause qui sopra.
Sei invisibile o sei stato solo sfortunato?
Prima di concludere qualsiasi cosa, guarda come hai misurato. Le risposte di ChatGPT non sono deterministiche, quindi una prova sola dice quanto è uscito da un lancio di dadi. Quello che ti serve è un tasso di menzione: un set fisso di prompt realistici, scritti nella lingua dei tuoi clienti e senza il nome del tuo brand, eseguiti più volte in sessioni pulite e ripetuti nelle settimane successive. Il metodo passo passo è in Come scoprire se ChatGPT cita il tuo brand.
Sui piani a pagamento, Huntair SEO esegue a intervalli regolari i prompt che scegli su ChatGPT, Gemini, Claude e Perplexity e traccia il tuo tasso di menzione accanto alle posizioni delle tue keyword su Google, così una correzione pubblicata la prima settimana ha un numero attaccato alla quarta.
La diagnosi in 30 minuti
- Apri
/robots.txtsul dominio di produzione e cerca OAI-SearchBot, per nome e dentro ogni bloccoUser-agent: *. Su GPTBot decidi a parte. - Scarica una pagina importante senza browser e cerca nell'HTML la frase che vorresti vedere citata. Se non c'è, la pagina va prerenderizzata.
- Verifica che la pagina risponda 200, sia nella sitemap e non stia dietro a una catena di redirect o a un muro di consenso.
- Fai a ChatGPT cinque domande che ti fanno i clienti, in sessioni nuove e senza il tuo nome, annota chi viene citato al tuo posto, e ripeti la prova quattro settimane dopo le correzioni.
FAQ
Ho bloccato GPTBot: resto fuori dalle risposte di ChatGPT?
No. GPTBot decide se i tuoi contenuti possono essere usati per addestrare i modelli di OpenAI. Comparire nelle risposte di ricerca di ChatGPT dipende da un altro user agent, OAI-SearchBot, che OpenAI documenta a parte. Puoi rifiutare l'addestramento e restare visibile nella ricerca.
Il mio sito si posiziona bene su Google. Perché ChatGPT non lo cita?
Perché i due crawler fanno un lavoro diverso. Google dichiara di poter elaborare i contenuti generati da JavaScript quando gli script sono raggiungibili, mentre i principali crawler AI di OpenAI, Anthropic e Perplexity non lo eseguono. Un sito costruito come applicazione lato client può tenere un buon posizionamento su Google e consegnare a ChatGPT un documento vuoto.
Quanto tempo passa prima di comparire, dopo le correzioni?
Settimane, non giorni, e dipende dalla causa che hai chiuso. Sbloccare un crawler di ricerca e pubblicare HTML leggibile hanno effetto solo quando quelle pagine vengono riscaricate, e il modello deve comunque preferire la tua pagina a quelle che già usa. Rimisura dopo quattro settimane, non la mattina dopo.
Conviene tradurre il sito in inglese per comparire su ChatGPT?
Non come scorciatoia. Se i tuoi clienti chiedono in italiano, la pagina che deve rispondere è quella italiana; la versione inglese serve alle domande in inglese. Se lavori su entrambi i mercati, tieni le due versioni collegate e coerenti nelle informazioni sul brand.
Aggiungere dati strutturati FAQ o Article serve per farsi citare dai modelli AI?
Aiuta le macchine a leggere la pagina, ma non è un biglietto d'ingresso. Google dichiara che i dati strutturati non sono richiesti per le sue funzioni generative e che non c'è un markup speciale da aggiungere per quelle. I dati strutturati si guadagnano comunque il loro posto nel resto della SEO, quindi tienili accurati e identici al testo che vede una persona.