Aller au contenu
Tout en local

Robots.txt tester

Vérifiez si des chemins ou URL spécifiques sont autorisés ou bloqués par un fichier robots.txt.

Entrée
Chemins ou URL à tester (un par ligne)
Sortie

Robots.txt tester

Collez le contenu de votre fichier robots.txt, listez les chemins ou URL complets que vous voulez vérifier, et cet outil vous dit exactement lesquels un crawler peut récupérer et lesquels sont bloqués. Il est conçu pour le moment où une page disparaît mystérieusement des résultats et vous devez confirmer en secondes si une règle Disallow en est la cause — sans déploiement, sans attendre un rapatriement en direct.

Sélectionnez le crawler dans la liste — Googlebot, Googlebot-Image, Bingbot, GPTBot, ClaudeBot — ou entrez un jeton personnalisé pour tester votre propre bot. L'outil applique la même logique que les vrais crawlers : la règle la plus longue gagne, un Allow bat un Disallow de même longueur, et "*" (toute séquence de caractères) et "$" en fin (fin de chemin) fonctionnent exactement comme dans un vrai robots.txt. Activez "Afficher la règle décisive" pour voir précisément quelle ligne Allow ou Disallow a produit chaque résultat, pour que vous cessiez de deviner.

Au-delà des chemins individuels, le rapport liste chaque ligne Sitemap déclarée et tout Crawl-delay défini pour l'agent utilisateur sélectionné, et signale les problèmes de syntaxe — une directive sans deux-points, une règle avant toute ligne User-agent, ou des champs que les crawlers ne reconnaissent pas. Choisissez un tableau simple pour une lecture rapide ou JSON pour traiter le résultat avec un script ou une vérification CI.

Tout s'exécute dans votre navigateur. Le contenu robots.txt et les chemins que vous testez ne sont jamais uploadés nulle part, il est donc sûr de vérifier les règles pour des sites pas encore lancés ou protégés par mot de passe.

FAQ

Comment l'outil décide-t-il si un chemin est autorisé?
Il choisit la règle Allow ou Disallow avec le motif correspondant le plus long pour l'agent utilisateur sélectionné. Si un Allow et un Disallow correspondent avec exactement la même longueur, Allow gagne. Un chemin sans règle correspondante est autorisé par défaut.
Quels user-agents puis-je tester?
Présets pour Googlebot, Googlebot-Image, Bingbot, GPTBot et ClaudeBot, ou sélectionnez "Personnalisé" et entrez un jeton user-agent pour tester un crawler qui n'est pas dans la liste.
Les jokers sont-ils supportés?
Oui. "*" correspond à toute séquence de caractères dans un motif, et "$" en fin ancre la correspondance à la fin exacte du chemin — la même syntaxe que Google, Bing et les autres crawlers implémentent.
Que signifient les avertissements?
Ils signalent les problèmes de syntaxe : une ligne sans deux-points, un Allow, Disallow ou Crawl-delay avant toute ligne User-agent, ou des directives que les crawlers ne reconnaissent pas.
Mon robots.txt ou ma liste de chemins est-il uploadé quelque part?
Non. L'analyse et la correspondance se font entièrement dans votre navigateur — rien de ce que vous collez ici n'est envoyé à un serveur.