Per scoprire se ChatGPT cita il tuo brand non devi chiedere del tuo brand: devi fare le domande che fanno i tuoi clienti ("qual è il miglior X per Y?") e vedere se compari nella risposta. Fallo in una sessione pulita, ripetilo più volte su più modelli AI, e registra non solo se vieni menzionato ma come. I controlli una tantum non dicono quasi nulla: le risposte AI cambiano da un'esecuzione all'altra, quindi ciò che ti serve è un tasso di menzione, tracciato nel tempo.
Ecco il metodo, passo passo, e dove stanno i suoi limiti.
Punti chiave
- Testa domande di categoria ("miglior X per Y"), mai il nome del tuo brand: il riconoscimento non è visibilità.
- Usa sessioni pulite e ripeti ogni prompt: le risposte AI variano da un'esecuzione all'altra, quindi la metrica è un tasso di menzione, non un controllo singolo.
- Annota competitor, posizione e come vieni descritto: un tasso significa qualcosa solo nel confronto.
- Fatto a mano, un ciclo di misura è di circa 400 conversazioni su quattro modelli: è il lavoro che gli strumenti di monitoraggio automatizzano.
Perché non basta chiedere "conosci [il mio brand]?"
Perché la risposta è lusinghiera e inutile. Interrogato direttamente, un modello recupera o ricorda qualcosa su quasi ogni brand con un sito web. Questo non dice niente sul momento che conta commercialmente: quando un potenziale cliente fa una domanda di categoria ("miglior strumento SEO per una piccola agenzia", "alternative a X") e il modello compone una rosa di nomi. Vuoi sapere se sei in quella rosa. È un test completamente diverso, ed è quello che copre questa guida.
Passo 1: scrivi i prompt che i tuoi clienti usano davvero
Costruisci una lista di 10-20 prompt realistici su quattro tipi di intento:
- Categoria: "Qual è il miglior strumento di [categoria] per [pubblico]?"
- Problema: "Come faccio a [lavoro che il tuo prodotto svolge]?", dove una buona risposta nominerebbe degli strumenti.
- Confronto: "[Competitor] contro alternative: cosa scelgo?"
- Varianti locali/di nicchia: le stesse domande con i qualificatori del tuo mercato ("...per un e-commerce italiano", "...con un budget piccolo").
Scrivili come li digiterebbe una persona vera, con la specificità di chi ha fretta. Escludi i prompt che contengono il nome del tuo brand: quelli misurano il riconoscimento, non la visibilità.
Passo 2: eseguili in condizioni pulite
Il tuo ChatGPT loggato ti conosce: memoria, istruzioni personalizzate e cronologia contaminano le risposte. Per ogni test:
- usa una chat nuova con la memoria disattivata (o una sessione in incognito/sloggata),
- non "scaldare" la conversazione: il prompt di test va per primo,
- annota se il modello ha navigato il web o risposto a memoria, quando è visibile: la distinzione corrisponde alle due porte descritte in Come i modelli AI scelgono quali brand citare.
Passo 3: registra più di un sì/no
Per ogni prompt ed esecuzione, annota:
| Campo | Perché conta |
|---|---|
| Menzionato? (tu / competitor) | Il segnale di visibilità di base, il loro quanto il tuo |
| Posizione nella risposta | Il primo nome pesa più di un "da tenere d'occhio" |
| Come vieni descritto | Categoria sbagliata o fatti datati sono un problema a sé da correggere |
| Sentiment / riserve | "Valido ma caro" orienta le decisioni |
| Fonti citate | Quali pagine si sono guadagnate la citazione: le tue o la recensione di qualcun altro su di te |
Le colonne dei competitor non sono opzionali. "Menzionato in 3 esecuzioni su 10" da solo non si interpreta; accanto a "competitor A: 9 su 10" diventa una roadmap.
Posizione e formulazione meritano le colonne in più. Il paper di ricerca che ha introdotto la GEO misura la visibilità con metriche che pesano dove compare una citazione nella risposta e quanta parte della risposta occupa, non solo se è presente, e aggiunge un punteggio soggettivo per rilevanza, influenza e unicità (Aggarwal et al., KDD 2024).
Passo 4: ripeti, perché una risposta è un aneddoto
Le risposte AI non sono deterministiche: stesso prompt, stesso modello, stesso giorno possono produrre rose diverse. Una singola esecuzione ti dice com'è andato un lancio di dadi. Una misura sensata richiede:
- più esecuzioni per prompt (5-10 danno un tasso utilizzabile),
- più modelli: ChatGPT, Gemini, Claude e Perplexity recuperano in modo diverso e sanno cose diverse; essere visibili su uno dice poco sugli altri,
- ripetizioni regolari (settimanali o mensili), così vedi se il tuo lavoro GEO muove il numero.
È lo stesso cambio di paradigma descritto in GEO vs SEO: da un ranking deterministico a un tasso di menzione campionato.
I conti onesti del farlo a mano
Venti prompt × 5 esecuzioni × 4 modelli = 400 conversazioni per ciclo di misura, ognuna con la sua sessione pulita e la sua annotazione strutturata, poi l'aggregazione in tassi e tendenze. Come audit una tantum è mezza giornata ben spesa, e vale la pena farlo una volta, anche solo per toccare con mano il problema. Come pratica mensile, è un part-time, e la parte meno automatizzabile (valutare in modo coerente posizione, sentiment e descrizione) è esattamente quella dove il lavoro manuale diventa impreciso.
È il lavoro per cui esiste il monitoraggio della visibilità LLM. Sui piani a pagamento, Huntair esegue a intervalli regolari i prompt che scegli su ChatGPT, Gemini, Claude e Perplexity, traccia il tuo tasso di menzione contro i competitor nel tempo, e lo mette accanto ai dati SEO tradizionali, così un'unica dashboard risponde sia a "mi posiziono?" sia a "vengo citato?".
E se il verdetto è "sei invisibile"?
Allora hai scoperto qualcosa che la maggior parte dei tuoi competitor non sa di sé, e la cura ha un percorso definito:
- Verifica prima la recuperabilità: pagine leggibili senza JavaScript e crawler di ricerca AI ammessi nel robots.txt: OAI-SearchBot per ChatGPT, Claude-SearchBot per Claude, PerplexityBot per Perplexity e Google-Extended se vuoi che Gemini fondi le risposte sulle tue pagine. È la causa più comune e più rapida da sistemare.
- Rendi i contenuti citabili: pagine answer-first, titoli in forma di domanda, dati veri. I pattern sono in Cos'è la GEO: guida pratica.
- Metti a fuoco la tua entità: un nome, una categoria, una descrizione, ovunque.
- Rimisura: stessi prompt, stesso metodo, quattro settimane dopo. Il tasso è il tuo tabellone.
FAQ
Ogni quanto dovrei ricontrollare la mia visibilità AI?
Mensile è il minimo per avere una tendenza; settimanale se stai pubblicando attivamente contenuti GEO e vuoi un riscontro su cosa muove il numero. La cosa più importante è tenere stabile il set di prompt, così i cambiamenti riflettono i modelli, non le tue domande.
Il mio brand compare ma è descritto male. È un problema?
Sì, probabilmente più dell'assenza. Una categoria sbagliata o prezzi datati ti seguono in ogni risposta. Correggi la fonte: prima le tue pagine, poi le pagine di terzi che i modelli citano su di te (directory, recensioni, articoli di confronto).
Devo testare tutti e quattro i modelli?
Se i tuoi clienti li usano, sì. Il retrieval è diverso, perché ogni provider gestisce e documenta un proprio crawler di ricerca e un proprio indice, quindi la visibilità su un modello davvero non si trasferisce. Come minimo, testa i due che il tuo pubblico usa di più.
Le risposte di ChatGPT sul mio brand possono cambiare anche se io non cambio nulla?
Sì: aggiornamenti dei modelli, refresh degli indici e semplice varianza di campionamento muovono le risposte. È esattamente il motivo per cui la metrica è un tasso di menzione su esecuzioni ripetute, non un controllo singolo.