Blog

Cloudflare bloque Googlebot depuis le 15 septembre : vérifiez vos paramètres avant de disparaître de Google

Pauline Viseur
Co-fondatrice & CEO
RÉSUMÉ DE L'ARTICLE

Cet article publié par Agence Norry analyse le changement de paramètres Cloudflare entré en vigueur le 15 septembre 2026. Il explique pourquoi les sites qui ont activé le blocage des robots IA bloquent aussi Googlebot, Bingbot et Applebot par effet de bord, quels sites sont concernés, et comment vérifier et corriger ses paramètres en moins de cinq minutes.

Les chiffres à retenir

IndicateurChiffreSourceDate du changement15 septembre 2026CloudflareAnnonce officielle1er juillet 2026Blog CloudflareBots affectésGooglebot, Bingbot, ApplebotCloudflareSites concernés (nouveaux)Tous nouveaux domaines CloudflareCloudflareSites concernés (existants)Ceux ayant activé Block Training ou Block AI BotsCloudflareVisibilité dans les logsAucune (blocage au niveau réseau)Crawl LabErreur retournéeHTTP 403 sur le sitemap et les pagesSearch Engine JournalDélai avant impact SEO visiblePlusieurs semainesObservations terrain

Ce que Cloudflare a changé et pourquoi

Le 1er juillet 2026, Cloudflare a annoncé ce qu’ils ont appelé leur « Content Independence Day » : une refonte complète de leur système de gestion des robots IA. Au lieu d’un seul toggle « Bloquer les bots IA », Cloudflare classe maintenant les crawlers en trois catégories.

CatégorieCe que fait le botExemplesDéfaut depuis le 15/09SearchIndexe pour les moteurs de rechercheGooglebot (Search), Bingbot (Search)AutoriséAgentAgit en temps réel au nom d’un utilisateurAgents IA, crawlers conversationnelsBloqué sur pages avec pubTrainingCollecte des données pour entraîner des modèlesGPTBot, CCBot, Google ExtendedBloqué sur pages avec pubMixed (Search + Training)Indexe ET collecte pour l’entraînement IAGooglebot, Bingbot, ApplebotBloqué si Training = Block

Le problème se situe dans la dernière ligne. Googlebot, Bingbot et Applebot font partie des mixed-purpose crawlers : ils indexent pour la recherche classique, mais ils collectent aussi des données utilisées pour les fonctionnalités IA des moteurs (AI Overviews, AI Mode). Cloudflare ne peut pas séparer les deux usages au niveau de la requête. Règle appliquée par Cloudflare depuis le 15 septembre : un bot multi-usage est traité selon la règle la plus restrictive. Si Training = Block, Googlebot est bloqué. Même si Search = Allow.

Pourquoi c’est silencieux et dangereux

Le blocage ne se passe pas sur votre serveur. Il se produit au niveau du réseau Cloudflare, en amont de votre infrastructure.

  • Vos logs serveur ne montrent rien. La requête de Googlebot n’atteint jamais votre serveur. Pas d’erreur dans vos logs Apache ou Nginx. Juste une absence.
  • Votre robots.txt est inutile. Le blocage est appliqué avant que Googlebot puisse lire votre robots.txt.
  • Google Search Console ne déclenche pas d’alerte immédiate. L’outil d’inspection d’URL peut montrer des erreurs 403 si vous testez manuellement, mais pas de notification automatique pour un blocage progressif.
  • L’impact SEO arrive avec un décalage. Les pages déjà indexées restent dans Google pendant des semaines le temps que le cache expire. Vous ne voyez la chute de trafic qu’après que le problème existe depuis longtemps.

Un propriétaire de site a signalé le problème dès août 2026, avant l’entrée en vigueur officielle : en passant AI Training = Block, Googlebot et Bingbot recevaient des HTTP 403 sur son sitemap.

Quels sites sont concernés

Profil de siteSituationRisqueNouveau domaine ajouté depuis le 15/09Training et Agent bloqués par défaut sur pages avec pubMoyen : Googlebot bloqué si Training activéCompte Free tier existant sans modificationNouveaux défauts appliqués automatiquementÉlevé si pages monétiséesSite existant avec Block AI Bots activéGooglebot bloqué sur pages où la règle s’appliqueTrès élevé : probablement déjà actifSite existant avec Block Training activéMême effetTrès élevéClient payant sans modification de paramètresConfiguration existante conservéeFaible si aucun blocage Training actif

Ce que ça change pour le SEO et le GEO

L’impact va au-delà du référencement classique. Googlebot crawle désormais pour deux usages simultanément : l’index de recherche classique et les fonctionnalités IA (AI Overviews, AI Mode). Bloquer Googlebot, c’est donc bloquer les deux.

Pour les sites qui travaillent leur visibilité dans les réponses IA (stratégie GEO), c’est doublement problématique. Non seulement vos pages ne sont plus indexées pour Google Search, mais elles ne peuvent plus être lues pour alimenter les AI Overviews actifs en France depuis le 22 juillet 2026. Au moment où être cité par les IA devient un enjeu stratégique majeur, une case cochée par précaution peut vous en exclure complètement.

Comment vérifier vos paramètres en moins de 5 minutes

  • Étape 1 : accédez à votre tableau de bord Cloudflare. Connectez-vous et sélectionnez le site concerné.
  • Étape 2 : allez dans Security. Cliquez sur Security, puis Bot Management ou AI Crawlers selon votre version de l’interface.
  • Étape 3 : vérifiez le paramètre Training. Si Training est sur Block, vous bloquez potentiellement Googlebot. Passez-le sur Disallow, pas sur Block.
  • Étape 4 : vérifiez le paramètre Block AI Bots (legacy). Si l’ancien toggle Block AI Bots est activé, il déclenche aussi le blocage Training. Désactivez-le ou migrez vers les nouveaux contrôles granulaires.
  • Étape 5 : activez Bot Preference Sync. Ce paramètre garantit la cohérence entre vos règles et les nouvelles catégories. Les nouveaux domaines l’ont activé par défaut, les anciens peuvent avoir besoin de l’activer manuellement.
  • Étape 6 : vérifiez dans Google Search Console. Utilisez l’outil d’inspection d’URL sur plusieurs pages clés. Si Googlebot retourne des erreurs 403, le blocage est actif.

Attention à la distinction Disallow vs Block. Disallow envoie un signal que les bots bienélevants respectent. Block est un blocage réseau dur : Googlebot ne peut pas passer. La confusion entre les deux est à l’origine de la plupart des incidents signalés.

Vouloir bloquer les IA ET rester visible sur Google : c’est possible

Il est tout à fait possible de protéger son contenu contre l’entraînement des modèles IA sans bloquer Google. Il faut utiliser les bons outils.

  • Google Extended (recommandé). C’est le robot spécifique de Google pour l’entraînement IA et les produits comme Gemini. Le bloquer dans votre robots.txt empêche l’utilisation de vos contenus pour l’entraînement, sans toucher à Googlebot et donc sans impact sur votre indexation Search.
  • GPTBot d’OpenAI. Dédié à l’entraînement de ChatGPT. Distinct du bot qui alimente ChatGPT Search. Le bloquer dans robots.txt protège vos contenus sans conséquence sur votre visibilité Google.
  • CCBot (Common Crawl). Utilisé par de nombreux modèles open source. Facilement bloqué dans robots.txt.

Ce que cet incident révèle

Cet incident illustre une tension réelle qui s’installe en 2026 : les propriétaires de sites doivent maintenant gérer simultanément leur visibilité sur les moteurs de recherche classiques, leur visibilité dans les réponses IA, et la protection de leurs contenus contre l’entraînement de modèles. Ces trois objectifs peuvent entrer en conflit. La bonne approche n’est pas de tout bloquer par précaution, ni de tout laisser passer par défaut. C’est de comprendre quels bots font quoi, et de paramétrer ses outils en conséquence.

Vous voulez un audit de votre configuration Cloudflare et de votre visibilité IA ?

Norry accompagne les entreprises sur l’ensemble de leur stratégie de visibilité digitale : SEO technique, GEO, configuration des accès robots et audit complet.

Questions fréquentes sur le blocage Cloudflare et Googlebot

Pourquoi Cloudflare bloque-t-il Googlebot depuis le 15 septembre 2026 ?

Cloudflare classe désormais les crawlers en trois catégories : Search, Agent et Training. Googlebot, Bingbot et Applebot sont des mixed-purpose crawlers qui font à la fois de la recherche et de la collecte pour l’entraînement IA. Depuis le 15 septembre 2026, la règle la plus restrictive s’applique : si Training = Block, ces bots sont bloqués, même si Search = Allow. Les sites ayant activé Block AI Bots ou Block Training voient Googlebot bloqué par effet de bord.

Comment savoir si Googlebot est bloqué sur mon site Cloudflare ?

Le blocage étant appliqué au niveau réseau, il n’apparaît pas dans vos logs serveur. La seule façon de le détecter est d’utiliser l’outil d’inspection d’URL de Google Search Console sur vos pages principales. Si Googlebot retourne des erreurs HTTP 403, le blocage est actif. Vérifiez aussi les paramètres Training et Block AI Bots dans Security de votre tableau de bord Cloudflare.

Comment bloquer les robots IA sans bloquer Googlebot ?

La solution est de passer par votre fichier robots.txt plutôt que par les paramètres Cloudflare Training. Bloquez Google Extended (le bot de Google pour l’entraînement IA), GPTBot (OpenAI) et CCBot (Common Crawl) dans votre robots.txt. Ces bots sont distincts de Googlebot et leur blocage n’a aucun impact sur votre indexation Search. Dans Cloudflare, laissez le paramètre Training sur Disallow, pas Block.

Quels sites sont concernés par le changement Cloudflare du 15 septembre 2026 ?

Trois profils sont principalement concernés : (1) les nouveaux domaines ajoutés à Cloudflare depuis le 15 septembre, qui reçoivent les nouveaux défauts automatiquement ; (2) les comptes Free tier existants sans modification de paramètres ; (3) tous les sites existants qui avaient activé Block AI Bots ou Block Training avant le 15 septembre. Les clients payants dont les paramètres n’ont pas changé conservent leur configuration d’origine.

Résumé généré par IA
Vous n’avez pas le temps de lire cet article ? Nous vous proposons un résumé avec l’IA de votre choix :
ChatGPT Logo ChatGPT
Grok Logo Grok
Perplexity Logo Perplexity
Sommaire

Et si votre site devenait lui aussi un levier de croissance ?

Passez à un site Webflow sans dépendances, rapide, IA-Ready™, livré avec retours illimités et une méthode AEO/GEO qui vous place devant vos concurrents.
+100 projets Webflow livrés - B2B, SaaS, finance, tech