Misurare la visibilità su AI Overview, AI Mode e ChatGPT: cosa è davvero osservabile

Cosa si misura davvero su AI Overview, AI Mode e ChatGPT e cosa no: le fonti ufficiali del 2026, i limiti dichiarati e le metriche inventate.

AUTHOR: Donato Pirolo
PUBLISHED: Agosto 26, 2026
MODIFIED: Agosto 28, 2026
Misurare la visibilità su AI Overview, AI Mode e ChatGPT: cosa è davvero osservabile

Quattro cose si misurano con dati ufficiali: le impressioni nelle funzioni AI in Search Console, le citazioni in Bing Webmaster Tools, le sessioni dal canale Assistenti AI in GA4, i passaggi dei crawler AI verificati per IP nei log. Una quinta si campiona, con l’incertezza accanto. Il resto è stima.

Sì: misurare la visibilità su AI Overview, AI Mode e ChatGPT si può. La risposta “tanto non si misura niente” è vecchia. Da giugno 2026 Search Console ha un rapporto dedicato, da febbraio 2026 Bing Webmaster Tools ne ha uno che arriva più in là.

Sotto c’è un registro, con la fonte accanto a ogni riga. Comprese le tre cose che mezza SERP dà per osservabili senza esserlo: Google-Extended nei log, il traffico da AI Overview in GA4, la posizione dentro un’overview.

Citazione, impressione, clic: tre eventi diversi

Tre eventi in fila: la citazione dentro una risposta generata, l'impressione che ne mostra solo la parte scorsa dall'utente e il clic, l'unico che arriva alla pagina e lascia una traccia certa nei dati del sito.

Sono tre eventi distinti. Solo il terzo lascia una traccia certa nei tuoi dati. È il più raro.

  • Citazione: il tuo URL compare come fonte dentro una risposta generata.
  • Impressione: quella fonte viene mostrata sullo schermo di una persona.
  • Clic: la persona la tocca e arriva da te.

Fra il primo evento e il terzo si perde quasi tutto. È qui che entra la zero click search: la risposta viene consumata dentro la SERP o dentro la chat, il clic non parte, la tua analytics registra un silenzio che somiglia all’irrilevanza senza esserlo.

Confondere i tre eventi manda in vacca metà delle misurazioni: “ci citano tanto”, detto guardando GA4, significa “ci cliccano tanto”. Il resto del quadro sta nel pillar cosa cambia davvero nella SEO per le AI.

Il registro degli osservabili: come misurare la visibilità su AI Overview, AI Mode e ChatGPT

Quattro livelli: dato ufficiale di piattaforma, dato tuo di prima parte, campionamento con incertezza dichiarata, non osservabile. Ogni riga ha la sua sezione sotto.

Cosa vuoi sapereDove si vedeTipo di datoFonte
Compaio nelle funzioni AI di Google?Search Console, rapporto AI generativaLivello 1, piattaformaGoogle
Quante volte Copilot mi cita?Bing Webmaster Tools, AI PerformanceLivello 1, piattaforma (grounding queries campionate)Microsoft
Chi arriva da ChatGPT o Gemini?GA4, canale Assistenti AILivello 2, prima parteGoogle
Quali bot AI leggono le mie pagine?Log del server, verificati per IPLivello 2, prima parteOpenAI, Anthropic, Perplexity
Compaio nelle risposte di ChatGPT?Prompt set fisso, ripetutoLivello 3, campionamentonessuna piattaforma
Quante citazioni senza clic?Da nessuna parteLivello 4, non osservabilevedi sotto

Le metriche SEO classiche non spariscono, cambiano di ruolo: impressioni, clic e CTR restano i KPI più solidi che hai. Salta l’anello dopo: la posizione, che dentro un’AI Overview non esiste come dato, e la query, assente dal rapporto generativo.

Search Console e AI Overview: un rapporto con una metrica sola

Da giugno 2026 il rapporto dedicato esiste. Mostra una metrica sola: le impressioni organiche dalle funzioni AI.

Cosa c’è dentro, secondo la documentazione: quattro dimensioni (pagine, paesi, date, dispositivi), rollout su un sottoinsieme di proprietà, limite di 1.000 righe, esperimenti di Search Labs esclusi, Discover a parte. Cosa non c’è: dimensione query, clic, separazione fra AI Overviews e AI Mode.

Il resto non sparisce: i siti che compaiono nelle funzioni AI restano nel traffico di ricerca complessivo, dentro il tipo di ricerca Web.

La frase “non esiste un report separato per le AI Overview” era vera quando è stata scritta. Gira ancora in mezza guida pubblicata prima di giugno 2026, e va aggiornata più che discussa.

Come si contano le impressioni

Due regole di conteggio cambiano la lettura di ogni numero. Stanno nella pagina sulle metriche.

Prima. Per le AI Overview valgono le regole standard: un’impressione si conta quando l’elemento compare nella pagina di risultati, che l’utente lo abbia scorso fino a vederlo oppure no, purché non debba cliccare per vedere altri risultati. L’eccezione riguarda gli elementi dentro widget che scorrono o si espandono in modo indipendente, un carosello o una sezione che si apre: lì l’impressione scatta solo se il link viene portato in vista dentro il widget o aperto con un clic.

Seconda. L’AI Overview occupa una singola posizione, e tutti i link al suo interno ricevono quella. Qualunque KPI di “rilevanza posizionale”, tipo “sono la fonte del primo paragrafo”, poggia su un numero che Search Console non produce.

Una nota in più. Il clic su un link esterno dentro AI Overview e AI Mode conta come clic, ma finisce nel calderone della ricerca Web.

AI Mode cambia le carte: ogni follow-up è una query nuova, con impressioni, posizione e clic propri, e lì la posizione segue la metodologia normale della SERP. È lo stesso meccanismo del query fan-out di cui parlo nella guida alla keyword research: una domanda dell’utente ne genera diverse, e ognuna ha i suoi numeri.

CTR che scende a impressioni costanti: come si legge (e cosa non prova)

Il confronto genera ipotesi da verificare a mano, non serie storiche. Il limite va detto prima del metodo: non distingue un AI Overview da un featured snippet, da un carosello di immagini o da un competitor arrivato in terza posizione. Tutti e quattro schiacciano il CTR.

Il metodo è un export e una sottrazione. Prendi due finestre omogenee dall’export di Search Console, stessa lunghezza, stessi giorni della settimana, stesso paese, stesso dispositivo, poi confronta query per query. La forma che cerchi è una: impressioni che tengono, posizione media che tiene, CTR che scende. Quelle query sono i tuoi sospetti.

Poi si va a mano: apri quelle query in incognito, in italiano, e guardi cosa c’è sopra il primo risultato blu. Lavoro artigianale che non scala. Tienilo su una lista corta.

Fra gli approcci di AI Overview tracking in giro è il più economico: usa un dato che hai già. E fra le metriche SEO classiche il CTR resta il KPI più sensibile a quello che ti succede sopra, purché non gli si chieda la causa.

Bing Webmaster Tools: dove le citazioni AI sono un dato pubblicato

Un motore pubblica le tue citazioni AI. È Microsoft.

Il report AI Performance è in public preview dal 10 febbraio 2026: citazioni totali, media di pagine citate al giorno, grounding queries (le frasi che l’AI ha usato per recuperare il contenuto), attività per URL. Il 16 giugno 2026 sono arrivati Intents, Topics, Citation Share e Compare. Superfici: Copilot, riassunti AI di Bing, partner.

I limiti li mette per iscritto Microsoft, e sono più stretti di come vengono raccontati. Sulle grounding queries scrive che il dato mostrato è un campione dell’attività di citazione complessiva, e che la metrica verrà raffinata man mano che processano altri dati. Sulle altre metriche una dichiarazione di campionamento non c’è: non estenderla a tutto il report, e non darla per assente. Quello che il report non contiene, invece, si vede a occhio: niente clic, niente traffico. Citation Share è dichiarata metrica osservazionale, non un sistema di ranking. Le etichette di Topics, in preview, possono restare generiche.

Per ChatGPT e Claude non c’è niente di simile: le pagine pubbliche documentano i bot e robots.txt. Si fermano lì.

Se il sito è già verificato in Bing Webmaster Tools, apri il report e scarica la serie.

GA4 e il canale Assistenti AI che quasi nessuno cita

GA4 misura i clic. Già più di quello che la maggior parte dei siti sta guardando.

Esiste un gruppo di canali predefinito chiamato Assistenti AI: raccoglie chi arriva da ChatGPT, Gemini, Deepseek, Copilot o Grok. C’è già, non va costruito. In mezza SERP italiana non compare.

Lo stesso documento contiene la correzione che vale il pezzo: quel canale esclude esplicitamente AI Overview e AI Mode, che restano dentro Ricerca organica. Il consiglio “segmenta in GA4 il traffico dagli AI Overview” non si può eseguire, e non perché sia difficile: quel traffico, per definizione di canale, sta altrove.

Il referral da chatgpt.com conta chi ha cliccato. Chi ti ha solo letto dentro la risposta resta fuori, insieme a chi arriva da un’app che non passa il referrer. Una sessione non è una citazione.

Operativamente: rapporto a parte per il canale Assistenti AI, confronto mese su mese, nessuna somma con le impressioni di Search Console.

I log: quali AI crawler passano davvero dal tuo sito

I log del server come registro degli ingressi: ogni AI crawler che passa lascia la sua riga, uno non è distinguibile dagli altri user agent e la citazione resta fuori dal registro, perché i log dicono chi è passato a leggere, non chi ti ha citato.

I log dicono chi è passato a leggere. Chi ti abbia citato, quello no: la distinzione da sola toglie metà degli errori in giro.

Leggere una tabella di AI crawler è come guardare il registro di un condominio: sai chi è salito e a che ora. Cosa abbia raccontato una volta uscito, quello no.

User agentScopo secondo la fonteVerifica
GPTBot (OpenAI)Crawl di contenuti usabili per l’addestramentoRange IP
OAI-SearchBot (OpenAI)Far comparire i siti nella ricerca di ChatGPTRange IP
ChatGPT-User (OpenAI)Azioni avviate dall’utente in ChatGPT e Custom GPTRange IP
OAI-AdsBot (OpenAI)Validazione della sicurezza delle pagine inviate come annunciRange IP
ClaudeBot (Anthropic)Raccolta di contenuti web che possono contribuire all’addestramentoRange IP
Claude-User (Anthropic)Accesso alle pagine quando un utente interroga ClaudeRange IP pubblicati, doc aggiornata al 7 aprile 2026
Claude-SearchBot (Anthropic)Navigazione per migliorare i risultati di ricercaRange IP pubblicati, doc aggiornata al 7 aprile 2026
PerplexityBot (Perplexity)Indicizzare e linkare i siti nei risultati, non per addestrare i modelliRange IP
Perplexity-User (Perplexity)Azioni dell’utente; ignora in genere robots.txt perché la richiesta parte dall’utenteRange IP
GoogleOther (Google)Crawl generico, non legato alla RicercaListe JSON

Due note. La pagina di Anthropic, aggiornata al 7 aprile 2026, li documenta come tre agenti distinti. Perplexity-User è l’unico bot per cui “l’ho bloccato” non significa “non passa”: se dai per scontata la porta chiusa, il conteggio parte storto.

Cosa leggere: frequenza, profondità, URL, codici di stato. Un 404 servito a OAI-SearchBot è un problema tuo. Cosa non dedurre: una visita di GPTBot non è una citazione, il silenzio di un bot non è un’esclusione. E se pensi che un llms.txt aiuti, i numeri dicono altro.

Google-Extended compare nei log server?

No, non compare, e lo scrive Google. Google-Extended non ha una stringa user agent HTTP separata: il crawling avviene con gli user agent Google già esistenti. È un token di robots.txt: governa un permesso, l’uso dei contenuti per addestrare i modelli Gemini e per il grounding in Gemini Apps e Vertex AI. Nessuna riga nel log.

Il pezzo che chiude il ragionamento, e che in SERP italiana manca: le funzioni AI dentro la Ricerca si governano con le direttive per Googlebot. Non c’è modo, lato log, di isolare “Google che legge per l’AI Overview”. L’altra metà del fatto, già nel pillar: bloccare Google-Extended non incide sull’inclusione in Google Search, e non è un segnale di ranking.

Caso pratico. Se in un report di log analysis compare una riga Google-Extended, quella riga la scrive il tool: leggi la sua regola di classificazione prima di portare il numero in riunione.

Come verifichi che quel GPTBot nei log sia davvero GPTBot

Con il DNS oppure con gli IP. La stringa user agent da sola non prova niente: nella pagina sulla verifica dei crawler Google avverte che al tuo sito arrivano richieste che dichiarano di venire da Google senza venirci.

Reverse DNS più forward DNS di conferma. Risolvi l’IP al nome host, poi quel nome host di nuovo a IP: deve tornare l’indirizzo iniziale.

Confronto dell’IP con i feed pubblicati. Google pubblica i propri range in file JSON, fra cui common-crawlers.json, special-crawlers.json e user-triggered-fetchers.json. Lo stesso fanno OpenAI nella documentazione dei bot, Anthropic in claude.com/crawling/bots.json, Perplexity nella pagina dei crawler. Regola secca: un conteggio di hit non verificato per IP non è un dato, è rumore con un nome sopra.

Io l’ho automatizzato una domenica e poi l’ho lasciato lì a girare. Lavoro noioso che ti ripaga ogni volta che qualcuno ti mostra un grafico di crawl AI in crescita e puoi chiedere: verificato per IP?

Prompt tracking: campionare le risposte, con l’incertezza in chiaro

Il prompt tracking è un sondaggio. È anche l’unico modo di monitorare la visibilità AI su ChatGPT, Claude e Perplexity, dove nessuna piattaforma pubblica rapporti per i publisher.

Una cosa in chiaro prima del protocollo: la variabilità delle risposte è una proprietà documentata del sistema, non rumore della tua rilevazione. OpenAI scrive che con lo stesso parametro seed gli output sono “(mostly) deterministic” e che il determinismo può saltare per modifiche lato loro, rilevabili dal campo system_fingerprint. Google scrive che AI Mode e AI Overviews possono usare modelli e tecniche diverse, quindi risposte e link variano, e che l’AI Overview compare solo quando la ritengono additiva: spesso non si attiva.

Il protocollo minimo sta in cinque righe.

  • Set di prompt fisso e versionato, in un repo con un numero di versione: cambi un prompt, cambi versione.
  • n ripetizioni per prompt, la stessa per tutti, decisa prima di guardare i risultati.
  • Tre registrazioni separate: menzione del brand, citazione con URL, raccomandazione esplicita. Collassarle in un unico “sì” produce un numero vuoto.
  • Le variabili di contesto: data, motore, modalità, lingua, località, versione del set. Senza quelle sei righe due misurazioni non sono confrontabili.
  • L’accuratezza di quello che dice di te. Se sbaglia i fatti è un problema di entità, e lo copre la guida al knowledge graph.

Un dettaglio che nelle cinque pagine italiane che ho letto non compare: AI Mode è in italiano e in Italia dall’8 ottobre 2025. Campionare in inglese su località USA vuol dire misurare un altro mercato: scrivilo accanto al numero.

Quante ripetizioni servono per poter dire qualcosa

Con dieci esecuzioni non puoi dire niente su una variazione di pochi punti.

La presenza del brand in un set di risposte è una proporzione stimata su un campione, quindi ha un intervallo di confidenza intorno, e quell’intervallo si stringe in un modo solo: aumentando n. Da qui esce una regola di lettura, una sola. Confronta due periodi solo se gli intervalli non si sovrappongono. Se si sovrappongono, quello che hai visto è compatibile con il caso.

Misurare uno scarto di pochi punti con dieci esecuzioni è come stimare la profondità di una piscina infilandoci un dito: qualcosa senti, la cifra però te la stai inventando.

La conseguenza ribalta la pratica corrente (cento prompt campionati una volta sola). Meglio pochi prompt campionati bene, sempre gli stessi. E un obbligo senza eccezioni: n accanto a ogni percentuale. Se l’intervallo non l’hai calcolato, scrivilo.

Cosa misura davvero un AI visibility score

I tool campionano output, come faresti tu, con un set di prompt che non vedi. Poi chiamano score il risultato.

Non è un’accusa, è la descrizione del metodo. Nessuna API di piattaforma restituisce la tua quota di citazioni su ChatGPT o Perplexity, quindi qualunque numero ti arrivi viene da prompt eseguiti da altri, con parametri che nel report non ci sono. Gli indici che girano coi nomi più diversi, AI visibility score, share of voice AI, presence rate, hanno la stessa architettura sotto.

La riga che chiude il capitolo l’ha scritta Google, nella stessa pagina in cui indica il proprio rapporto come strumento di misura: nessuno strumento di terze parti ha accesso ai suoi sistemi interni di ranking o AI. Nelle cinque pagine italiane che ho letto per questo pezzo non la riporta nessuna.

Non li rende inutili: li rende campionamenti privati, da valutare come valuteresti un sondaggio. Prima di fidarti di un KPI GEO di un tool, chiedi sei cose.

  1. Quanti prompt compongono il set?
  2. Quante ripetizioni per prompt?
  3. Quale lingua e quale località?
  4. Con che cadenza si rileva?
  5. Come viene definita una menzione: nome, URL citato, raccomandazione?
  6. Il dato italiano è rilevato o estrapolato dall’inglese?

Cosa non è osservabile, nemmeno pagando

Sei domande, oggi, non hanno risposta misurabile. Accanto a ciascuna il motivo, e la fonte dove esiste.

  1. Quante volte sei stato citato senza clic su ChatGPT o Perplexity. Al 26 agosto 2026 né OpenAI né Perplexity documentano un conteggio di citazioni per dominio: le pagine pubbliche coprono solo bot e robots.txt.
  2. Quante persone hanno davvero guardato la citazione. L’impressione dice che il link era nella pagina, non che qualcuno lo ha letto: le regole di conteggio contano l’elemento comparso, scrollato o no. L’unica eccezione sono i link dentro widget che scorrono o si espandono in modo indipendente: lì contano solo se vengono portati in vista dentro il widget o aperti con un clic.
  3. La tua posizione dentro un AI Overview. L’overview occupa una posizione sola e tutti i link ricevono quella, stessa fonte. Il numero non esiste. Nemmeno il KPI che ci si costruisce sopra.
  4. Quali query hanno attivato la citazione nelle funzioni AI di Google. Il rapporto generativo non ha la dimensione query, documentazione.
  5. Le impressioni separate fra AI Overviews e AI Mode. Lo stesso rapporto le aggrega, stessa fonte.
  6. Perché il modello ha scelto te invece del concorrente. Al 26 agosto 2026 nessuna piattaforma documenta i criteri di selezione delle fonti.

Se un numero risponde a una di queste sei domande, è una stima. Trattalo come tale, anche quando è bello.

Il cruscotto minimo per monitorare la visibilità AI: quattro serie separate più una campionata

Quattro serie di dati, tenute separate. Più una quinta, campionata.

  1. Impressioni nelle funzioni AI generativa, da Search Console.
  2. Citazioni totali e grounding queries, da Bing Webmaster Tools.
  3. Sessioni dal canale Assistenti AI, da GA4.
  4. Hit dei crawler AI verificati per IP, dai log.
  5. Presenza nel prompt set, con n e intervallo accanto.

Due regole rendono onesto il monitoraggio. La prima: non sommare mai serie che misurano eventi diversi, perché un’impressione di Search Console, una citazione di Bing e una sessione di GA4 non sono la stessa unità. La seconda: non leggere variazioni sotto la soglia di rumore, che vale per gli intervalli del prompt set come per le grounding queries campionate di Bing.

Cadenza mensile. Nel changelog vanno data, strumento, filtri, versione del prompt set, più ogni cambio di metodo. Nessuno score aggregato: il numero unico è comodo e basta.

Apri quel file oggi, anche vuoto. Alla terza rilevazione ti dirà se è cambiato il fenomeno o se sei cambiato tu.

Domande frequenti

Sei risposte secche, ognuna con la fonte accanto.

Esiste un rapporto ufficiale che mi dice se compaio nelle AI Overview?+

Sì. Da giugno 2026 Search Console ha il rapporto sul rendimento dell’AI generativa. Mostra le impressioni organiche dalle funzioni AI su quattro dimensioni: pagine, paesi, date, dispositivi. Niente clic, niente query, nessuna separazione fra AI Overviews e AI Mode. È in rollout parziale.

Posso vedere quali query hanno attivato una citazione nelle funzioni AI di Google?+

No. Il rapporto sull’AI generativa non ha la dimensione query. Su Bing Webmaster Tools ci sono le grounding queries, le frasi che l’AI ha usato per recuperare il contenuto: dato diverso dalla domanda dell’utente, valido solo per le superfici Microsoft.

Il traffico da AI Overview si segmenta in GA4?+

No. Il gruppo di canali predefinito Assistenti AI raccoglie ChatGPT, Gemini, Deepseek, Copilot e Grok, ed esclude esplicitamente AI Overview e AI Mode. Quel traffico resta in Ricerca organica, lo scrive la documentazione di GA4: il consiglio di segmentarlo non è eseguibile.

Vedo Google-Extended nei log del mio server?+

No. Google-Extended non ha una stringa user agent HTTP separata: il crawling avviene con gli user agent Google esistenti. È un token di robots.txt che governa l’uso dei contenuti per addestrare i modelli Gemini, non un bot che lascia righe nel log.

Esiste una Search Console per ChatGPT, Claude o Perplexity?+

No. Fra i motori e gli assistenti che documentano pubblicamente strumenti per publisher, al 26 agosto 2026 solo Bing Webmaster Tools pubblica un rapporto sulle citazioni AI. OpenAI, Anthropic e Perplexity documentano crawler e robots.txt, niente di più.

Perché lo stesso prompt dà risposte diverse?+

Perché il sistema funziona così, e le due aziende lo scrivono. OpenAI: con lo stesso seed gli output sono “(mostly) deterministic”, e il determinismo può saltare per modifiche lato loro. Google: AI Mode e AI Overviews possono usare modelli e tecniche diverse, quindi risposte e link variano.

Donato Pirolo

Donato Pirolo

Consulente SEO & AI

Aiuto aziende e professionisti a crescere nei risultati organici e generativi, unendo SEO tecnica, strategia dei contenuti e ottimizzazione per i motori AI (GEO).

Lascia un commento