Le spam dans Gemini Notebook a vécu 3 jours

Le 19 septembre 2026, Charles Floate a écrit sur X qu'il avait "piraté" l'AI Overview avec les moyens de Google lui même: il a posé son texte sur une page publique de Gemini Notebook, le service de Google pour travailler avec des documents et des notes, et cette page s'est retrouvée dans la réponse générée du moteur. Le 22 septembre, Search Engine Roundtable comptait plus de 12,000 pages de ce type dans l'index: peptides, codes promo, contenu pour adultes, liens vers des applications. Le 23 septembre, Google a retiré le répertoire des notebooks publics des résultats et a nettoyé le spam. La fenêtre a vécu environ 3 jours, et c'est une illustration très précise de la façon dont s'ouvrent et se referment les failles sur les domaines forts des autres.
Ce qu'est Gemini Notebook et pourquoi ses pages se sont retrouvées dans les résultats de Google
Gemini Notebook, c'est l'ancien NotebookLM, un service de Google où vous chargez vos sources (textes, liens, PDF) et où le modèle répond à partir d'elles, fait des synthèses et des revues. Le 16 juillet 2026, Google a renommé NotebookLM en Gemini Notebook, fin juillet 2026 il l'a déplacé vers l'adresse notebook.google.com, et l'ancien notebooklm.google.com redirige désormais vers la nouvelle (d'après les éléments publiés par nlmtools).
Le détail clé: un notebook peut être rendu public, et il reçoit alors une URL ordinaire sur le domaine de Google. Donc le moteur l'explore et l'indexe comme n'importe quelle autre page. Le 21 septembre 2026, Gagan Ghotra a publiquement qualifié cela de nouvelle tactique de SEO parasite: les notebooks publics s'indexent, et ceux qui travaillent avec des méthodes black hat s'en servent.
Comment fonctionne le SEO parasite et pourquoi le domaine de Google faisait un donneur si commode
Le SEO parasite, c'est quand on pose le contenu non pas sur son propre site, mais sur un site fort qui appartient à quelqu'un d'autre. Dans les consignes aux évaluateurs de Google, la formulation est simple: le contenu est placé sur un site hôte avant tout pour profiter des signaux de classement que ce site a déjà accumulés. Les donneurs classiques, ce sont les grands médias avec leurs rubriques "contenu partenaire", les forums, les sites de petites annonces, toute plateforme ouverte au contenu des utilisateurs.
Dans cette logique, le domaine google.com est un donneur au niveau de confiance maximal. Une page qui s'y trouve n'a pas besoin de gagner sa réputation, elle en hérite. D'où la vitesse: selon Search Engine Roundtable, le 22 septembre l'index contenait plus de 12,000 pages, soit une moyenne d'environ 4,000 nouvelles pages par jour sur les 3 jours pendant lesquels la tactique a vécu publiquement.
Il y avait même un signe tout à fait artisanal. Le 22 septembre 2026, Glenn Gabe a montré que sur une de ces pages, le prompt qui avait servi à la générer était visible directement dans les résultats. Autrement dit, les gens ne prenaient même pas la peine de cacher l'instruction qui avait donné naissance au texte.
- 19 septembre 2026Charles Floate montre une page Gemini Notebook dans un AI Overview
- 21 septembre 2026Gagan Ghotra parle de tactique de SEO parasite, Glenn Gabe confirme l'ampleur
- 22 septembre 2026Search Engine Roundtable trouve plus de 12,000 pages dans l'index
- 23 septembre 2026Google retire le répertoire des notebooks publics des résultats et nettoie le spam
Pourquoi Google n'a pas effacé 12,000 pages en une heure, alors qu'il le pouvait
Search Engine Roundtable a directement relevé l'étrangeté: Google pouvait supprimer ces pages de l'index instantanément, puisque le domaine est le sien, et il ne l'a pas fait. Trois jours de spam sur son propre domaine, pour une entreprise qui distribue à tout le monde des recommandations sur la qualité, cela coûte cher en réputation.
Il y a deux explications, banales toutes les deux. La première: une modification manuelle de l'index selon un motif d'URL, c'est une décision que quelqu'un doit prendre et signer, pas un bouton à disposition de l'ingénieur de garde. La seconde: il faut d'abord fermer la possibilité elle même, sinon le nettoyage n'a aucun sens, les pages se remplissent à nouveau en 24 heures. Le 23 septembre, le répertoire des notebooks publics a disparu des résultats, autrement dit ils ont réparé la source, pas seulement la conséquence.
Conclusion pratique pour ceux qui surveillent leurs concurrents: la réaction d'une plateforme au spam n'est presque jamais instantanée, mais elle arrive. On ne peut pas planifier son travail sur l'idée que "Google ne remarque rien", parce qu'ils ont remarqué en 2 jours après le premier tweet.
La politique site reputation abuse: ce qui est interdit et combien de temps Google a mis à l'appliquer
Cette histoire n'est pas nouvelle, elle a déjà sa règle. Google a annoncé la politique site reputation abuse en mars 2024, en même temps que deux voisines: scaled content abuse (génération massive de pages sans valeur) et expired domain abuse (achat de domaines expirés pour leur historique). D'après l'analyse de Digital Hitmen, la chronologie est la suivante:
- mars 2024: la politique est annoncée;
- 5 et 6 mai 2024: les premières actions manuelles tombent, soit environ 2 mois après l'annonce;
- janvier 2025: la formulation sur le contenu parasite est ajoutée aux consignes des évaluateurs;
- août 2025: l'application algorithmique est renforcée par une mise à jour anti spam, soit environ 17 mois après l'annonce.
Autrement dit, le chemin entre "nous interdisons cela" et "nous l'attrapons par algorithme" a pris un an et demi à Google. C'est précisément dans cet écart que vivent toutes les tactiques de ce genre. Et ce même écart explique pourquoi une faille fraîche sur un nouveau service se referme à la main et vite, tandis que les schémas systémiques sur de vieux donneurs traînent pendant des années.
Un autre détail utile à connaître: en novembre 2025, la Commission européenne a ouvert une enquête sur l'application de cette même politique, Search Engine Journal en a parlé. Le reproche porte sur le fait que des éditeurs légitimes, qui publient des contenus partenaires, tombent sous les sanctions. Google défend sa position. Concrètement, cela veut dire que les formulations de la politique vont encore bouger.
Faut il se glisser dans ce genre de fenêtres: je compte avec les chiffres de cette histoire
Je compte honnêtement. La fenêtre a vécu 3 jours entre la première révélation publique et le nettoyage. Pendant ce temps, plus de 12,000 pages sont entrées dans l'index, et toutes ont été balayées d'un seul geste. Aucune ne s'est transformée en actif: ni en abonné, ni en profil de liens accumulé, ni en marque.
Et maintenant le second chiffre. Le 22 septembre 2026, Peec AI (Malte Landwehr) a montré que la part des AI Overviews contenant des liens externes était passée de presque 0% à plus de 25%. Il y a un an, la réponse générée ne renvoyait quasiment rien vers l'extérieur, aujourd'hui une sur quatre le fait. La chance d'entrer dans la réponse de Google avec son propre site est plus élevée qu'avant, et elle ne s'évapore pas au bout de 3 jours.
Ma réponse est donc celle ci: il faut regarder ces fenêtres, il ne faut pas s'y engouffrer avec son projet principal. Trois jours de vie contre un domaine dans lequel on a investi plusieurs années, ce n'est pas un marché.
Cela dit, il faut se battre pour une place dans la réponse avec de plus en plus de finesse. Le 22 septembre 2026, on a remarqué qu'une partie des liens à l'intérieur des AI Overviews ne mène pas vers des sites, mais vers AI Mode, le mode recherche conversationnelle à l'intérieur de Google. Le même jour, Search Engine Land a écrit que Google testait dans Discover un bouton "Dive deeper": le clic ne mène pas vers l'article de l'éditeur, mais vers une synthèse générée du sujet à l'intérieur de Google. Ces deux choses raccourcissent le chemin de l'utilisateur vers le site, elles ne l'allongent pas.
Comment repérer ce genre de fenêtre avant les autres
Il ne faut pas surveiller les tweets, mais l'index lui même. Toute cette histoire se voit avec l'opérateur de recherche site appliqué au domaine du service: si un produit a des pages publiques, elles y seront. Ensuite la question est de savoir ce qui vit dessus.
Pour ce type de vérification, je tiens un tableau simple: colonne "service", colonne "date à laquelle des pages publiques sont apparues", colonne "ce que j'ai trouvé avec site en 5 minutes", colonne "date de vérification". Toutes les 2 semaines, je parcours la liste de haut en bas. Sans ce tableau, j'oublie la moitié des services au bout d'un mois.
- toutes les 2 semaines, vérifier avec l'opérateur site les nouvelles sections publiques des grands services
- regarder si une page publique porte un noindex et si on peut la créer sans modération
- noter la date de la première révélation publique d'une tactique, pour savoir depuis combien de temps la fenêtre vit
- ne pas transposer la tactique sur son domaine principal, même si elle fonctionne chez un concurrent
- vérifier si vos contenus sont reformulés sur des pages tierces, en cherchant une phrase unique de votre texte entre guillemets
Comment protéger son site du scraping vers les notebooks des autres
La seconde moitié de cette histoire ne concerne pas ceux qui spamment, mais ceux à qui on prend du contenu. Avec le passage de NotebookLM à Gemini Notebook, le user agent du chargeur qui récupère les pages sur commande de l'utilisateur a changé lui aussi: il s'appelle désormais Google-GeminiNotebook. Search Engine Journal a écrit que votre site peut ainsi être chargé dans le notebook de quelqu'un d'autre et reformulé sans mention de la paternité.
Ce qu'il faut faire, d'après le même article de Search Engine Journal:
- Chercher dans les logs du serveur les requêtes avec le user agent Google-GeminiNotebook et regarder quelles pages sont récupérées.
- Inscrire une interdiction pour ce user agent dans le robots.txt, si vous décidez de vous fermer.
- Mettre un blocage au niveau du WAF, c'est à dire du filtre de requêtes placé devant le site, parce que c'est plus fiable que des règles dans le robots.txt.
- Décider en conscience: en vous fermant, vous perdez aussi la chance d'être mentionnée, car une reformulation peut amener quelqu'un jusqu'à vous.
Personnellement, je ne me fermerais pas entièrement, je séparerais: les pages commerciales et les études originales méritent d'être protégées, les contenus de synthèse, qu'on les cite.
Ce qu'il faut faire en une heure
- Vérifier son domaine avec l'opérateur site et s'assurer qu'il n'y a pas dans l'index de pages étrangères issues de vos sections ouvertes: profils, commentaires, fichiers téléversés. N'importe quel site avec publication sans modération peut devenir donneur pour du SEO parasite.
- Trouver une phrase unique dans un de vos contenus forts, la chercher entre guillemets et voir qui reformule votre texte sur un autre domaine.
- Ouvrir les logs et chercher Google-GeminiNotebook, puis décider si vous le bloquez ou non.
- Si vous analysez une baisse de trafic, se souvenir que le 23 septembre 2026, dans la Search Console, une journée de données a de nouveau disparu du rapport d'exploration (celle du 15 septembre 2026): un trou dans le graphique ne signifie pas toujours un problème sur le site.
Des 12,000 pages qui avaient attrapé le domaine de Google, il ne restait rien au 23 septembre 2026. De ceux qui, ces jours là, écrivaient tranquillement leurs propres pages, personne n'est resté les mains vides.


