Avete aperto il vostro report sui bot IA all’inizio di settembre e dentro c’è un crollo. Intorno al 20 agosto una linea che era salita tutto l’anno scende di tre quarti e non torna più. Forse vi è arrivato dalle analisi dei bot del vostro CDN, forse da uno strumento di visibilità basato sui log, forse in una dashboard che vi manda la vostra agenzia.
Non siete i soli, e non è il vostro sito. Lo stesso crollo è arrivato su ogni proprietà che abbiamo misurato, negli stessi tre giorni, e anche una seconda che abbiamo controllato in modo indipendente lo mostra.
La vostra dashboard però vi sta mostrando solo metà di quello che è successo. Negli stessi giorni il numero di persone in arrivo da ChatGPT si è mosso di poche unità percentuali. Nessuno ha smesso di venire. Due numeri che si erano seguiti per mesi si sono separati in un fine settimana, e gli strumenti che contano l’attività dei crawler vi mostrano solo quello che è sceso.
Il resto è cosa è cambiato, perché è successo, e come leggere i vostri numeri ora che i due si sono separati.
Cosa è cambiato
Tra il 19 e il 21 agosto 2026, le richieste di pagina dai crawler riconosciuti di OpenAI sono scese a circa un quarto di quello che erano e sono rimaste lì. Ogni proprietà che analizziamo lo mostra. Una seconda, misurata in modo indipendente dai log edge grezzi, mostra un calo di circa il 75%.
L'ultimo punto è la media giornaliera sul resto del periodo anziché un singolo giorno, perché la cifra si è mossa a malapena una volta arrivata lì.
L’intera discesa ha richiesto due giorni, e i diciotto giorni successivi stanno piatti al nuovo livello. Un disservizio si sarebbe risolto entro allora.
Cosa non è cambiato
Le persone che arrivano da ChatGPT hanno continuato ad arrivare. Negli stessi giorni che hanno tolto tre quarti al numero dei crawler, gli arrivi si sono mossi di poche unità percentuali.
La cifra degli arrivi è misurata due volte per vie diverse e le due esecuzioni arrivano a pochi punti di distanza, quindi viene stampata come l'intervallo che coprono anziché come un numero singolo. La cifra dei crawler è il livello sostenuto nei diciotto giorni successivi.
Questa serie è rumorosa. Su un tratto comparabile all’inizio dell’estate senza nessun evento noto dentro, la stessa misurazione ha oscillato in media dell'8.7% tra periodi ordinari, e ha raggiunto il 18.8%. Uno spostamento di poche unità percentuali è il genere di cosa che fa comunque. Uno spostamento del 74% no.
Il numero dei crawler è caduto da un dirupo mentre il numero degli arrivi ha fatto qualcosa che questa serie fa quasi tutti i mesi. Quegli arrivi sono persone. Ognuna di loro ha letto una risposta, toccato un link al suo interno ed è arrivata sul sito, e sono il motivo per cui vi interessa essere citati.
Perché pensiamo che stia succedendo
Due cose sono scese insieme: il numero di volte in cui ogni pagina è stata richiesta, giù del 47%, e il numero di pagine distinte richieste, giù del 53%.
Quell’accoppiata esclude la prima spiegazione a cui pensano quasi tutti. Se un sistema stesse facendo caching delle vostre pagine in modo più aggressivo, ricontrollando copie che già possiede, vi aspettereste che richieda le stesse pagine meno spesso toccando comunque più o meno lo stesso insieme di pagine. L’insieme si è ridotto quanto la frequenza. Il caching da solo non produce questo.
Ridurre il query fanout sì. Quando chiedete qualcosa a ChatGPT Search, la domanda viene espansa in diverse sotto-query, ognuna delle quali va a prendere le proprie fonti. Tagliate il numero di sotto-query e raggiungete meno fonti, ciascuna meno spesso, cioè entrambi i numeri qui sopra che si muovono insieme.
Resoconti altrove nella stampa di settore attribuiscono il cambiamento di agosto esattamente a questo, una riduzione del query fanout di ChatGPT Search. Non abbiamo visto un annuncio ufficiale da OpenAI, quindi trattate la causa indicata come il resoconto di qualcun altro anziché come un fatto accertato. Quello che possiamo mostrarvi è la forma misurata, e combacia.
Gli stessi resoconti collocano il calo di Reddit all'86%. Messo accanto a circa il 73% e al 57% sulle due proprietà che abbiamo misurato, suggerisce che questo sia arrivato in modo ampio anziché su un tipo particolare di sito.
Come abbiamo verificato che il traffico fosse di OpenAI
Un crawler dice al vostro server quale software è. Quel nome è l’unica cosa che separa le richieste di OpenAI da quelle di chiunque altro, nei vostri log e nei nostri, ed è il punto debole sotto tutto quello che c’è sopra.
Una rinomina avrebbe prodotto prove identiche. Se OpenAI avesse rietichettato in silenzio un crawler, o spostato questo lavoro su un agente che nessuno ricollega a OpenAI, vedreste un cambiamento globale, dentro una finestra di 48 ore, su ogni proprietà, su codebase diversi, chiaramente visibile nei log grezzi. Esattamente quello che abbiamo visto.
Il controllo doveva quindi evitare del tutto i nomi. OpenAI pubblica gli intervalli IP da cui operano i suoi crawler. Contando le richieste da quegli intervalli anziché per user agent, il calo c’è ancora, al 63%, e non c’era nessun user agent sconosciuto nascosto al loro interno. Niente è stato rinominato. Il traffico davvero non sta arrivando.
Era l’unica alternativa che avrebbe imposto una rettifica, ed è morta.
Cos’altro non è
Durante l’analisi sono emerse altre due spiegazioni ed entrambe sono state eliminate. Sono qui perché una qualsiasi delle due avrebbe fatto una storia più ordinata di quella vera, e perché potreste star pensando a una di loro per i vostri dati.
- Un errore di reporting. Il calo c’è nei log grezzi ripuliti senza nessun classificatore da nessuna parte nel percorso. Le proprietà coinvolte girano su codebase diversi, e una di loro non ha avuto nessun rilascio in tutta la finestra. Il conteggio dei file di log grezzi al giorno non si è mai mosso.
- Una modifica al codice dalla nostra parte. Un rilascio è arrivato a un’ora molto comoda il 19 agosto. Qualcuno lo ha indicato come causa probabile e poi si è rimangiato tutto, perché le righe che tocca non possono portare il valore che questa metrica conta. Una tempistica comoda non è una prova.
- Una pulizia dei mirror da scraping. Copie di questi siti erano state raccolte con scraping e ripubblicate altrove, e la cosa è stata ripulita più o meno nello stesso periodo. È culminata il 14 agosto ed era finita entro il 16. Le richieste che toccavano percorsi mirror erano sotto il 2% del totale da entrambi i lati del cambiamento, e la loro quota è salita leggermente dopo anziché scendere.
Due cose non collegate sono capitate a una settimana di distanza. Qualsiasi spiegazione unica che copra entrambe è sbagliata in partenza.
Il vostro strumento IA conta una di tre cose diverse
Prima di poter leggere i vostri numeri dovete sapere quale di questi avete in mano. Il mercato della misurazione IA vende tre prodotti diversi e li descrive tutti e tre più o meno con lo stesso linguaggio. Guardano cose diverse.
| Cosa guarda il vostro strumento | Come ottiene il numero | Cosa ha mostrato ad agosto 2026 |
|---|---|---|
| Prompt tracking, o share of voice | Pone agli assistenti una serie di domande a intervalli regolari e registra se il vostro marchio viene nominato | Niente, per costruzione. Non conta mai le richieste dei crawler |
| Attività dei bot IA, dalle analisi dei bot del CDN o dai log del server | Conta le richieste dai crawler IA, identificati dal nome che il software dichiara | Tutto il calo di circa tre quarti |
| Arrivi dagli assistenti | Conta le persone che hanno toccato un link in una risposta e sono arrivate sul vostro sito | Una linea ordinaria |
Se state osservando tutto questo attraverso Profound, Searchable, o un altro strumento che legge i vostri log per l’attività dei bot IA, il calo che avete davanti non è una penalizzazione. Niente ha retrocesso il vostro sito, e niente che avete fatto lo ha causato. Quegli strumenti contano quanto spesso i crawler di OpenAI hanno chiesto le vostre pagine, e OpenAI ha cambiato quanto spesso chiede. Lo stesso calo è arrivato su ogni proprietà che abbiamo misurato, entro gli stessi tre giorni, e per un sito molto più grande è stato riportato un calo dell'86% quella settimana. Un cambiamento generalizzato nel comportamento di richiesta delle pagine produce esattamente questa forma in un report basato sui log, e non dice niente sulla vostra posizione.
Un prompt tracker non può mostrarvi questo evento. Un cambiamento nella frequenza con cui le vostre pagine vengono richieste non ha nessun percorso verso un numero costruito a partire dalle risposte. È un’affermazione su come funziona lo strumento anziché un risultato: non abbiamo misurato la visibilità lato risposta ad agosto, e questo articolo non sostiene che abbia tenuto o che sia scesa.
Gli strumenti che lo hanno mostrato stavano leggendo l’attività dei crawler, e hanno riportato il numero correttamente. Il problema comincia con quello che le persone gli fanno dire. Dite a chi gestisce un negozio che le sue citazioni IA sono scese del 74% ad agosto e gli avete detto qualcosa di vero su una metrica e di falso sui suoi clienti.
Come leggere i vostri nuovi numeri
- Estraete le stesse date da un report che conta persone anziché richieste. Un gradino di circa tre quarti nella settimana del 20 agosto 2026 accanto a una linea di arrivi ordinaria è questo evento, e non è pubblico perso.
- Chiedete a qualsiasi strumento che dice citazioni quale grandezza intende. Sia le richieste sia gli arrivi vengono chiamati così, e sullo stesso sito nello stesso mese differiscono di ordini di grandezza.
- Trattate il 20 agosto come una rottura nella serie anziché come un declino. Confrontare settembre con luglio su un conteggio di richieste ora misura due comportamenti diversi, quindi i vostri numeri anno su anno e mese su mese su quella metrica resteranno sbagliati finché non sarà passato un anno intero.
- Tenete la dashboard sui bot per quello in cui è brava, cioè dirvi se le vostre pagine sono raggiungibili e se vengono lette. Giudicate il canale sugli arrivi, e su cosa comprano quegli arrivi.
Agosto 2026 funziona come un test di qualunque misurazione IA su cui vi appoggiate. Qualsiasi strumento vi abbia mostrato un crollo quel mese stava riportando il comportamento dei crawler, e ora sapete cosa avrebbero dovuto mostrarvi invece quelli accanto.