Cloudflare bloque l'entraînement de l'IA sans bloquer Google
D'après Cloudflare Blog - Have it both ways: stay discoverable in search while disallowing AI training, relayé par Blog du Modérateur
Image : générée (Gemini)
Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.
Annonce commerciale : ce document émane de l'entreprise concernée.
À retenir
- La nouvelle case « Disallow AI Training » publie automatiquement une directive Disallow dans le fichier robots.txt du site, propre à l'entraînement seulement.
- Elle vise les robots dits à usage mixte, qui indexent ET entraînent des modèles avec les mêmes données, comme Googlebot, Applebot et Bingbot.
- Cloudflare crée le statut Accountable : Apple, Google et Microsoft l'obtiennent en s'engageant à respecter le refus d'entraînement sans toucher à l'indexation.
- Les robots qui n'entraînent QUE des IA, comme ceux d'Amazon, Anthropic, Meta et OpenAI, restent bloqués sans que la recherche en souffre.
- Avant ce changement, bloquer un robot mixte coupait aussi le site des résultats de recherche : un choix que beaucoup de propriétaires refusaient de faire.
Pourquoi ça compte
Jusqu'ici, un site qui voulait garder sa place dans Google devait accepter que ce même robot utilise aussi son contenu pour entraîner des IA. Cloudflare retire ce chantage technique en séparant les deux usages au niveau du robots.txt, ce qui redonne aux éditeurs un vrai choix plutôt qu'un dilemme tout ou rien.
Action concrète
Les propriétaires de sites utilisant Cloudflare peuvent activer Disallow AI Training dans leurs réglages Bot Management ou AI Crawl Control, plutôt que de choisir entre disparaître de Google et laisser leur contenu nourrir des IA sans contrôle.
Fondée sur la source originale
Sources
- Cloudflare Blog - Have it both ways: stay discoverable in search while disallowing AI training : Bryan Becker, 15 septembre 2026
- Relais média : Blog du Modérateur →