La question de bloquer ou non les crawlers IA est présentée comme technique, et elle ne l’est pas. Le blocage tient en quelques lignes de configuration et prend dix minutes. Le difficile, c’est de décider si vous le voulez, et cette décision est commerciale : vous choisissez entre protéger vos contenus d’un entraînement de modèle et rester présent dans les réponses que les internautes obtiennent désormais à la place d’une liste de résultats.

La plupart des conseils publiés en ligne choisissent un camp puis plaident pour lui. La position honnête est différente : la bonne réponse dépend du modèle économique, et un éditeur financé par les pages vues et une agence financée par les demandes entrantes doivent aboutir à des conclusions opposées.

L’arbitrage en une phrase : bloquer les crawlers IA empêche vos contenus d’être ingérés, et empêche du même coup d’être cité. Si votre chiffre d’affaires dépend de visiteurs qui arrivent sur votre page, le blocage vous protège. S’il dépend du fait que des gens sachent que vous existez puis vous contactent, le blocage vous retire de la surface où cette découverte se produit de plus en plus souvent.


Ce que Cloudflare a réellement changé

Le réglage par défaut s’est inversé. Le 1 juillet 2025, Cloudflare est devenu le premier grand fournisseur d’infrastructure à bloquer les crawlers IA par défaut , passant d’un modèle d’exclusion à un modèle d’autorisation explicite. Les nouveaux domaines sont interrogés dès leur création pour savoir si les crawlers IA peuvent les aspirer, et les entreprises d’IA ont maintenant besoin d’une permission déclarée, et non plus de la simple absence de refus.

Cela compte bien au-delà des clients de Cloudflare, car une part importante du trafic web transite par ce réseau. Un réglage par défaut n’est pas une règle, mais un réglage par défaut appliqué à cette échelle redessine ce que les entreprises d’IA peuvent tenir pour acquis.

L’outil s’appelle AI Crawl Control et il est disponible sur toutes les offres, y compris l’offre gratuite. Il vous montre quels services d’IA atteignent vos contenus, vous laisse poser des règles d’autorisation ou de blocage crawler par crawler, et vérifie si un crawler donné respecte robots.txt. Le vrai bénéfice est de voir ce trafic avant de décider quoi que ce soit, et la plupart des propriétaires de sites n’ont jamais regardé.

Cloudflare a aussi poussé les crawlers à déclarer leur finalité. Vous pouvez donc distinguer un robot qui entraîne un modèle, un robot qui récupère une page pour construire une réponse en direct, et un robot qui indexe pour la recherche. Ce sont trois marchés très différents, et jusqu’à récemment ils arrivaient chez vous sans être distinguables.

Le modèle économique a encore changé en juillet 2026

C’est ici que tout conseil écrit l’an dernier est devenu faux.

Pay Per Crawl avait été lancé en 2025 comme une place de marché où les éditeurs facturaient les entreprises d’IA à chaque récupération de page. Le 1 juillet 2026, Cloudflare a jugé ce modèle insuffisant et est passé à Pay Per Use , qui rémunère quand votre contenu crée de la valeur à l’intérieur d’une réponse, et non quand un robot télécharge une page.

Le raisonnement devient limpide dès qu’on voit le chiffre : plus de 50 % du trafic des crawlers IA récupère à nouveau des pages qui n’ont pas changé. Facturer à la récupération revient donc surtout à facturer du gaspillage. Facturer quand le contenu apparaît dans une réponse facture au contraire la chose qui a réellement remplacé une visite sur votre site.

Il est tôt. Les partenaires de lancement sont Ceramic.ai et You.com, ce n’est donc pas encore une source de revenus large pour une petite entreprise britannique. Traitez cela comme une direction prise par le marché, pas comme une ligne du budget de l’an prochain.

Il y a aussi une échéance à noter dans l’agenda. À partir du 15 septembre 2026, les crawlers à usage mixte seront bloqués par défaut sur les pages qui affichent de la publicité, sauf si le propriétaire modifie le réglage. Si vous diffusez de la publicité et dépendez du trafic renvoyé par les IA, ce réglage s’appliquera à vous sans que vous fassiez quoi que ce soit.

Ce que le blocage coûte vraiment

Trois choses, et seule la première est évidente.

Vous perdez les citations. Les réponses IA nomment leurs sources. Être un de ces noms est l’équivalent moderne d’un classement en première page, et un crawler bloqué ne peut pas citer ce qu’il n’a pas le droit de lire. Notre guide de la Generative Engine Optimization explique ce qui fait mériter une citation une fois que vous avez choisi d’être visible.

Vous perdez la mesure. Le trafic bloqué n’apparaît pas comme une perte dans vos rapports. Il apparaît comme rien du tout, ce qui est indiscernable de ne l’avoir jamais eu. Les sites qui ont bloqué tôt sont souvent incapables de dire ce que cela leur a coûté, parce que le scénario de comparaison n’a jamais été enregistré.

Vous n’arrêtez pas vraiment l’entraînement. Bloquer les crawlers bien élevés, ceux qui s’identifient et respectent robots.txt, écarte exactement ceux qui acceptent de suivre les règles. Le contenu déjà ingéré reste ingéré, et les aspirateurs qui ignorent robots.txt n’étaient jamais concernés. Vous ne pilotez que le comportement du sous-ensemble poli.

En face, le blocage protège vraiment une entreprise dont le produit est le contenu lui-même. Un éditeur sur abonnement, un cabinet d’études qui vend des rapports, une banque d’images : pour eux, une réponse IA qui résume le contenu remplace directement la vente, et la citation est une piètre compensation.

Comment décider de bloquer ou non les crawlers IA

Demandez-vous ce que vaut un visiteur et par quel chemin il se transforme en client.

Bloquez si votre contenu est le produit. Journalisme derrière un péage, études payantes, données de référence que vous cédez sous licence. La réponse IA entre en concurrence directe avec votre vente.

Autorisez si votre contenu est le marketing d’autre chose. Une agence logicielle, un cabinet de conseil, un cabinet d’avocats, une clinique. Vos articles existent pour que des acheteurs comprennent que vous savez résoudre leur problème. Être nommé dans une réponse est exactement la notoriété que vous payiez déjà, et la demande doit toujours arriver chez vous.

Autorisez de façon sélective si vous êtes entre les deux. Les règles crawler par crawler permettent d’accepter l’indexation pour la recherche tout en refusant l’entraînement, une position intermédiaire défendable maintenant que la finalité est déclarée.

Pour la plupart des entreprises qui lisent ceci, la réponse est d’autoriser. Le réflexe de blocage est protecteur et compréhensible, et il protège le plus souvent un contenu sans valeur commerciale propre tout en coupant le canal de découverte que ce contenu avait été écrit pour alimenter.

Par où commencer

Regardez le trafic avant de changer quoi que ce soit. AI Crawl Control montre, sur n’importe quelle offre, quels crawlers vous atteignent et à quelle fréquence. Un mois de ces données transforme une querelle idéologique en simple calcul.

Décidez ensuite crawler par crawler plutôt que globalement, et écrivez la décision avec sa date, car ce domaine a changé deux fois en 14 mois et changera encore.

Mecanik réalise des audits SEO techniques qui couvrent l’accès des crawlers IA et la visibilité en citation en plus des contrôles classiques, et met en place la configuration avec notre équipe de développement web . Si vous êtes bien classé et n’apparaissez jamais dans les réponses IA, l’accès des crawlers est la première chose à écarter.


Articles en relation: Agence SEO IA : prestations et tarifs , Google AI Mode et le trafic de votre site , WordPress piraté : supprimer le logiciel malveillant et Vitesse site Cloudflare : guide d’optimisation 2026 .


Questions fréquentes

Dois-je bloquer les crawlers IA sur mon site ? Tout dépend de la façon dont vous gagnez de l’argent. Bloquez si votre contenu est le produit, comme pour le journalisme payant ou les études vendues, parce qu’un résumé IA se substitue à la vente. Autorisez si votre contenu est le marketing d’un service, parce qu’être cité dans une réponse est précisément la notoriété que ce contenu devait créer, et que la demande arrive toujours chez vous.

Bloquer les crawlers IA empêche-t-il l’utilisation de mes contenus pour l’entraînement ? Seulement en partie. Cela arrête les crawlers bien élevés, ceux qui s’identifient et respectent robots.txt, c’est-à-dire exactement le sous-ensemble prêt à suivre les règles. Le contenu déjà ingéré reste ingéré, et les aspirateurs qui ignorent robots.txt n’ont jamais été concernés. Vous pilotez les crawlers polis, pas tous les crawlers.

Qu’est-ce que Cloudflare AI Crawl Control ? Une fonctionnalité Cloudflare, disponible sur toutes les offres y compris la gratuite, qui vous laisse voir quels services d’IA accèdent à votre site, poser des règles d’autorisation ou de blocage pour chaque crawler et suivre si chacun respecte robots.txt. Elle prend aussi en charge la facturation à la récupération. Sa plus grande utilité reste de regarder le trafic avant de décider quoi que ce soit.

Qu’est-ce qui a remplacé Cloudflare Pay Per Crawl ? Pay Per Use, annoncé le 1 juillet 2026. Au lieu de facturer les entreprises d’IA à chaque récupération de page, les éditeurs sont payés quand leur contenu crée de la valeur à l’intérieur d’une réponse. Le raisonnement de Cloudflare était que plus de 50 % du trafic des crawlers IA récupère des pages inchangées, si bien que la facturation à la récupération facturait surtout du gaspillage. Les partenaires de lancement sont Ceramic.ai et You.com.

Que se passe-t-il le 15 septembre 2026 ? Cloudflare commence à bloquer par défaut les crawlers IA à usage mixte sur les pages qui affichent de la publicité, sauf si le propriétaire modifie le réglage. Usage mixte désigne un crawler qui ne sépare pas l’indexation pour la recherche de l’entraînement et du trafic des agents. Si vous diffusez de la publicité et dépendez des renvois d’IA, ce réglage s’applique à vous sans aucune action de votre part.