Test robots.txt : vérifiez l’accès à votre page
Entrez l’adresse d’une page : son fichier robots.txt est récupéré automatiquement et la règle applicable est expliquée.
Renseignez les champs, puis lancez l’outil pour obtenir votre résultat.
Le fichier public est récupéré au moment du test. Les règles Allow et Disallow sont simulées ; le cache réel de Google et l’indexation de la page ne sont pas vérifiés.
Comment utiliser cet outil
- Saisissez l’adresse de la page que vous souhaitez tester.
- Choisissez le robot : son fichier robots.txt est récupéré à la racine du domaine.
- Vérifiez la règle retenue et les points à examiner avant de modifier le fichier.
Votre page peut-elle être explorée ?
Le test de robots.txt compare le chemin de votre page aux consignes destinées au robot choisi. Vous n’avez pas besoin de rechercher ou de copier le fichier. Le résultat distingue un chemin autorisé, un chemin bloqué et un fichier absent. Il ne prouve pas que la page est indexée.
Tester une URL qui semble bloquée à l’exploration
Saisissez l’adresse de la page concernée, puis choisissez le robot. L’outil récupère le fichier robots.txt à la racine du domaine et cherche les règles qui correspondent au chemin de votre URL.
Le résultat vous indique la règle retenue et sa ligne. Vous pouvez ainsi retrouver le passage à examiner dans le fichier, sans supposer que toutes les URL d’un site sont traitées de la même façon.
Une URL autorisée peut-elle rester absente de Google ?
Oui. Robots.txt concerne l’exploration. D’autres éléments interviennent ensuite, notamment les directives d’indexation et le contenu de la page. Pour savoir ce que Google connaît réellement de cette URL, utilisez son inspection dans Search Console.
Comment interpréter les résultats
- Testez une page stratégique et un chemin que vous souhaitez réellement exclure.
- Un fichier absent avec un statut 404 ou 410 n’interdit pas l’exploration.
- Une consigne robots.txt ne protège pas les données privées et ne remplace pas une directive noindex.
Pour approfondir, consultez notre guide sur robots.txt.
Pour vérifier les principes : documentation de référence.
Questions fréquentes
Dois-je rechercher moi-même le fichier robots.txt ?
Non. Saisissez l’URL de la page : le fichier est récupéré automatiquement à la racine du domaine.
Quelle règle gagne entre Allow et Disallow ?
La règle correspondante la plus spécifique l’emporte. À spécificité égale, l’autorisation est retenue. Les caractères * et $ sont pris en compte.
Que signifie un fichier absent ?
Une réponse 404 ou 410 indique qu’aucun fichier n’est disponible à cette adresse. Elle n’interdit pas l’exploration ; les autres erreurs sont signalées sans les interpréter comme une autorisation.
Une URL autorisée est-elle indexée dans Google ?
Pas nécessairement. L’autorisation d’exploration ne prouve pas l’indexation. Vérifiez la page, ses directives et l’inspection d’URL de Search Console.
Le résultat correspond-il exactement au cache de Google ?
Non. L’outil récupère le fichier au moment du test. Google peut utiliser une version en cache et appliquer un comportement dépendant de ses précédentes tentatives de récupération.