Lo spam in Gemini Notebook è durato 3 giorni

Il 19 settembre 2026 Charles Floate ha scritto su X di aver "bucato" l'AI Overview usando Google stesso: ha messo il suo testo su una pagina pubblica di Gemini Notebook, il servizio di Google per lavorare con documenti e appunti, e quella pagina è finita dentro la risposta generata nella ricerca. Al 22 settembre Search Engine Roundtable ne ha contate più di 12,000 nell'indice: peptidi, codici sconto, contenuti per adulti, link ad app. Il 23 settembre Google ha tolto dai risultati il catalogo dei notebook pubblici e ha ripulito lo spam. La finestra è durata circa 3 giorni, ed è un'illustrazione molto precisa di come si aprono e si chiudono i buchi sui domini forti altrui.
Cos'è Gemini Notebook e perché le sue pagine sono finite nei risultati di Google
Gemini Notebook è l'ex NotebookLM, il servizio di Google in cui carichi le tue fonti (testi, link, PDF) e il modello risponde basandosi su quelle, fa sintesi e panoramiche. Il 16 luglio 2026 Google ha rinominato NotebookLM in Gemini Notebook, a fine luglio 2026 lo ha spostato sull'indirizzo notebook.google.com, e il vecchio notebooklm.google.com ora reindirizza al nuovo (secondo i materiali di nlmtools).
Dettaglio chiave: un notebook può essere reso pubblico, e a quel punto ottiene un normale URL sul dominio di Google. Quindi la ricerca lo scansiona e lo indicizza come qualsiasi altra pagina. Il 21 settembre 2026 Gagan Ghotra ha definito pubblicamente tutto questo una nuova tattica di parasite SEO: i notebook pubblici vengono indicizzati, e di questo approfitta chi lavora con schemi black hat.
Come funziona il parasite SEO e perché il dominio di Google si è rivelato un donatore comodo
Il parasite SEO è quando il contenuto non viene messo sul proprio sito ma su un sito forte altrui. Nelle linee guida per i quality rater di Google la formulazione è semplice: il contenuto viene pubblicato su un sito donatore soprattutto per sfruttare i segnali di ranking che quel sito ha già accumulato. I donatori classici sono le grandi testate con le sezioni "contenuto sponsorizzato", i forum, i siti di annunci, qualsiasi piattaforma con contenuti generati dagli utenti.
In questa logica google.com è un donatore col massimo livello di fiducia possibile. Una pagina ospitata lì non deve guadagnarsi la reputazione, la eredita. Da qui la velocità: secondo i dati di Search Engine Roundtable, al 22 settembre nell'indice c'erano più di 12,000 pagine, cioè in media circa 4,000 pagine nuove al giorno nei 3 giorni in cui la tattica è vissuta alla luce del sole.
C'era anche un segnale del tutto domestico di lavoro artigianale. Il 22 settembre 2026 Glenn Gabe ha mostrato che nei risultati, su una di queste pagine, si vedeva il prompt con cui era stata generata. Cioè non nascondevano nemmeno l'istruzione da cui era nato il testo.
- 19 settembre 2026Charles Floate mostra una pagina di Gemini Notebook dentro un AI Overview
- 21 settembre 2026Gagan Ghotra la definisce una tattica di parasite SEO, Glenn Gabe conferma che il fenomeno è di massa
- 22 settembre 2026Search Engine Roundtable trova nell'indice più di 12,000 pagine
- 23 settembre 2026Google toglie dai risultati il catalogo dei notebook pubblici e ripulisce lo spam
Perché Google non ha cancellato 12,000 pagine in un'ora, pur potendo
Search Engine Roundtable ha notato apertamente la stranezza: Google poteva rimuovere quelle pagine dall'indice all'istante, visto che il dominio è suo, e non lo ha fatto. Tre giorni di spam sul proprio dominio, per un'azienda che distribuisce a tutti linee guida sulla qualità, sono cari a livello di reputazione.
Le spiegazioni sono due, ed entrambe banali. La prima: gli interventi manuali sull'indice per pattern di URL sono una decisione che qualcuno deve prendere e firmare, non un pulsante a disposizione dell'ingegnere di turno. La seconda: prima bisogna chiudere la possibilità in sé, altrimenti la pulizia è inutile, le pagine si riempiono di nuovo nel giro di un giorno. Il 23 settembre dai risultati è sparito il catalogo dei notebook pubblici, cioè hanno riparato la fonte, non solo l'effetto.
Conclusione pratica per chi osserva i concorrenti: la reazione della piattaforma allo spam quasi mai è immediata, ma arriva. Pianificare il lavoro sul principio "Google non se ne accorge" non si può, perché se ne sono accorti 2 giorni dopo il primo tweet.
La policy site reputation abuse: cosa è vietato e quanto ci ha messo Google ad applicarla
Questa storia non è nuova, ha già una regola pronta. La policy site reputation abuse Google l'ha annunciata a marzo 2024 insieme ad altre due: scaled content abuse (generazione massiva di pagine senza valore) e expired domain abuse (acquisto di domini scaduti per sfruttarne la storia). Secondo l'analisi di Digital Hitmen la cronologia è questa:
- marzo 2024: policy annunciata;
- 5 e 6 maggio 2024: partono le prime azioni manuali, cioè circa 2 mesi dopo l'annuncio;
- gennaio 2025: la formulazione sul contenuto parassita entra nelle linee guida dei quality rater;
- agosto 2025: l'applicazione algoritmica viene rafforzata con uno spam update, cioè circa 17 mesi dopo l'annuncio.
Quindi il percorso da "questo lo vietiamo" a "questo lo intercettiamo con l'algoritmo" a Google è costato un anno e mezzo. È esattamente in questo spazio vuoto che vivono tutte le tattiche di questo tipo. E lo stesso spazio spiega perché un buco fresco su un servizio nuovo si chiude a mano e in fretta, mentre gli schemi sistemici sui vecchi donatori si trascinano per anni.
Un altro dettaglio utile da sapere: a novembre 2025 la Commissione europea ha aperto un'indagine sull'applicazione proprio di questa policy, come ha scritto Search Engine Journal. L'accusa è che finiscano sanzionati editori legittimi che pubblicano contenuti in affiliazione. Google difende la sua posizione. In pratica questo significa che le formulazioni della policy si muoveranno ancora.
Conviene infilarsi in finestre così: faccio i conti con i numeri di questa storia
Conto onestamente. La finestra è durata 3 giorni dalla prima esposizione pubblica alla pulizia. In quel tempo sono entrate nell'indice più di 12,000 pagine, e sono state spazzate via tutte con un gesto solo. Nessuna si è trasformata in un asset: né in un iscritto, né in un profilo di link accumulato, né in un brand.
E adesso il secondo numero. Il 22 settembre 2026 Peec AI (Malte Landwehr) ha mostrato che la quota di AI Overviews con link esterni è cresciuta da quasi 0% a più del 25%. Un anno fa la risposta generata quasi non restituiva link verso l'esterno, oggi uno su quattro lo fa. La possibilità di entrare nella risposta di Google col proprio sito oggi è più alta di prima, e non brucia dopo 3 giorni.
Per questo la mia risposta è: guardare finestre così serve, infilarci dentro il proprio progetto principale no. Tre giorni di vita contro un dominio in cui hai investito diversi anni non è uno scambio.
Detto questo, conquistare un posto nella risposta richiede sempre più attenzione. Il 22 settembre 2026 si è notato che una parte dei link dentro le AI Overviews non porta a siti ma all'AI Mode, la modalità di ricerca in forma di chat dentro Google. Lo stesso giorno Search Engine Land ha scritto che Google sta testando in Discover il pulsante "Dive deeper": il clic non porta all'articolo dell'editore ma a una panoramica generata sull'argomento dentro Google. Entrambe le cose accorciano il percorso dell'utente verso il sito, non lo allungano.
Come accorgersi di una finestra così prima degli altri
Bisogna guardare non i tweet ma l'indice. Tutta questa storia si vede con l'operatore di ricerca site applicato al dominio del servizio: se un prodotto ha iniziato ad avere pagine pubbliche, lì compariranno. Poi resta da capire cosa ci vive sopra.
Per controlli di questo tipo tengo una tabella semplice: colonna "servizio", colonna "data in cui ha iniziato ad avere pagine pubbliche", colonna "cosa ho trovato con site in 5 minuti", colonna "data del controllo". Ogni 2 settimane scorro l'elenco dall'alto verso il basso. Senza tabella, dopo un mese metà dei servizi me li sono già dimenticati.
- ogni 2 settimane controllare con l'operatore site le nuove sezioni pubbliche dei grandi servizi
- verificare se la pagina pubblica ha il noindex e se si può crearla senza moderazione
- annotare la data della prima esposizione pubblica della tattica, per capire da quanto vive la finestra
- non portare la tattica sul dominio principale, anche se funziona per un concorrente
- controllare se i vostri materiali vengono riassunti su pagine altrui, cercando una frase unica del testo tra virgolette
Come proteggere il proprio sito dallo scraping dentro i notebook altrui
La seconda metà di questa storia non riguarda chi spamma, ma chi si vede prendere il contenuto. Insieme al cambio di nome da NotebookLM a Gemini Notebook è cambiato anche lo user agent del crawler che scarica le pagine su comando dell'utente: ora si chiama Google-GeminiNotebook. Search Engine Journal ha scritto che in questo modo il vostro sito può essere caricato nel notebook di un altro e riassunto senza indicazione dell'autore.
Cosa fare, secondo lo stesso materiale di Search Engine Journal:
- Cercare nei log del server le richieste con user agent Google-GeminiNotebook e vedere quali pagine vengono scaricate.
- Inserire il divieto per questo user agent nel robots.txt, se decidete di chiudervi.
- Mettere un blocco a livello di WAF, cioè del filtro delle richieste davanti al sito, perché è più affidabile delle regole nel robots.txt.
- Decidere con consapevolezza: chiudendovi perdete anche la possibilità di essere citati, visto che un riassunto può portare una persona da voi.
Io non mi chiuderei del tutto, farei una distinzione: le pagine commerciali e le ricerche originali vanno protette, i materiali divulgativi che li citino pure.
Cosa fare in un'ora
- Controllare con l'operatore site il proprio dominio e assicurarsi che nell'indice non ci siano pagine altrui arrivate dalle vostre sezioni aperte: profili, commenti, file caricati. Donatore per il parasite SEO può diventare qualsiasi sito che permetta di pubblicare senza moderazione.
- Prendere una frase unica da un vostro contenuto forte, cercarla tra virgolette e vedere chi riassume il vostro testo su un dominio altrui.
- Aprire i log e cercare Google-GeminiNotebook, poi decidere se bloccarlo o no.
- Se state analizzando un calo di traffico, ricordare che il 23 settembre 2026 in Search Console è di nuovo sparito un giorno di dati nel report sulla scansione (quello del 15 settembre 2026): un buco nel grafico non significa sempre un problema sul sito.
Delle 12,000 pagine che si erano agganciate al dominio di Google, al 23 settembre 2026 non è rimasto niente. Di chi in quei giorni scriveva con calma le proprie pagine, nessuno è rimasto senza niente.


