Générateur robots.txt pour les robots IA
Autorisez ou bloquez chaque robot IA en connaissance de cause, puis copiez le bloc à ajouter à votre robots.txt.
GPTBot collecte des pages pour entraîner les modèles OpenAI. Le bloquer n'a aucun effet sur votre présence dans ChatGPT. OAI-SearchBot, lui, alimente l'index de recherche de ChatGPT : c'est lui qui décide si votre page peut être récupérée, résumée et citée avec un lien. Le bloquer vous retire des réponses de ChatGPT. Beaucoup de sites ont copié un blocage de GPTBot en y ajoutant OAI-SearchBot « par sécurité », et se sont éliminés eux-mêmes du canal de trafic qu'ils cherchaient à travailler. Décidez ligne par ligne, pas en bloc.
Collecte des pages pour l'entraînement des modèles OpenAI.
Le bloquer ne vous retire pas des réponses de ChatGPT. C'est une décision sur vos données, pas sur votre visibilité.
Indexe les pages pour la recherche de ChatGPT.
C'est ce robot qui conditionne votre présence et votre lien dans les réponses ChatGPT. Le bloquer vous supprime des citations.
Contrôle les pages de destination des annonces ChatGPT Ads.
Nécessaire si vous comptez acheter de la publicité dans ChatGPT : sans lui, vos pages de destination ne peuvent pas être validées.
Va chercher une page en direct parce qu'un utilisateur a partagé le lien ou posé une question dessus.
Trafic déclenché par une personne réelle, en temps réel. Le bloquer revient à refuser une visite demandée explicitement.
Collecte des pages pour les modèles Claude.
Anthropic utilise aussi Claude-User pour les récupérations en direct et Claude-SearchBot pour la recherche : ce sont des agents distincts, à traiter séparément.
Indexe les pages pour les réponses sourcées de Perplexity.
Perplexity affiche systématiquement ses sources. Le bloquer, c'est renoncer à ces citations et au trafic qui va avec.
Jeton qui contrôle l'usage de votre contenu pour Gemini et l'ancrage des réponses.
Ce n'est pas un robot d'exploration : il ne change ni votre indexation ni votre classement dans Google Search.
Constitue un corpus public réutilisé par de nombreux entraînements.
Aucun bénéfice direct de visibilité : Common Crawl ne cite personne. C'est le premier candidat au blocage si vous protégez vos données.
Collecte des pages pour les modèles de ByteDance.
Réputé pour un rythme de crawl agressif. Beaucoup de sites le bloquent pour des raisons de charge serveur autant que de droits.
Collecte des pages pour les modèles de Meta et Meta AI.
Meta utilise plusieurs agents. Celui-ci est l'agent d'exploration documenté pour l'entraînement.
Jeton qui contrôle l'usage de votre contenu pour Apple Intelligence.
Il ne touche pas à Applebot, qui alimente Siri et Spotlight : votre présence dans la recherche Apple n'est pas affectée.
Ajoutez ce bloc à votre fichier robots.txt existant, à la racine du domaine. N'écrasez pas vos règles actuelles : robots.txt se lit par groupe User-agent, les vôtres continuent de s'appliquer aux autres robots.
Cet outil tourne entièrement dans votre navigateur. Aucune donnée saisie ici ne part sur nos serveurs, rien n'est enregistré, et il n'y a ni compte à créer ni quota à respecter. Nous pouvons donc l'offrir sans contrepartie : il ne nous coûte rien.
Ce que fait cet outil
Un robots.txt mal calibré est la façon la plus rapide de disparaître des réponses IA sans s'en rendre compte. La confusion la plus fréquente et la plus coûteuse concerne OpenAI : GPTBot et OAI-SearchBot ne font pas le même travail, et bloquer l'un pour l'autre a des conséquences opposées. Cet outil affiche le rôle réel de chaque robot avant de vous laisser trancher.
- Onze robots IA couverts, chacun avec son rôle réel : entraînement, recherche et citation, visite déclenchée par un utilisateur, publicité.
- Quatre préréglages, dont un qui garde les citations tout en refusant la collecte d'entraînement.
- Ajout de chemins interdits qui s'appliquent aux robots que vous laissez passer, pour protéger un espace client ou un panier.
- Ligne Sitemap ajoutée en fin de fichier, et commentaires qui rappellent le rôle de chaque robot.
- Génération locale : le fichier est fabriqué dans votre navigateur, rien n'est transmis.
Questions fréquentes
Bloquer GPTBot me fait-il disparaître de ChatGPT ?
Les robots respectent-ils vraiment robots.txt ?
Où placer ce fichier ?
Puis-je bloquer une partie du site seulement ?
Comment vérifier que mes règles sont appliquées ?
Aller plus loin que le générateur
Ces micro-outils produisent un fichier. Les scanners Ready2GEO, eux, vont chercher ce qui se passe réellement sur votre site et dans les réponses des moteurs IA.
Vérifie si votre site est réellement éligible et exploitable par la régie publicitaire de ChatGPT : accès des robots, structure, signaux commerciaux.
Tester mon site 🕷️ Analyseur de logs crawlers IACollez vos logs serveur : vous voyez quels robots IA passent vraiment, à quelle fréquence, et sur quelles pages ils se cassent les dents.
Analyser mes logs 🧭 Audit GEO completL'audit groupé agrège tous les scanners en un seul rapport, avec les correctifs priorisés et l'export PDF.
Lancer l'audit