PrestaShop génère un robots.txt correct par défaut, mais un catalogue qui grossit crée vite des URLs à bloquer que le fichier natif ne couvre pas : filtres, paramètres de tri, pages de recherche interne. Voici comment le configurer proprement, sans risquer de bloquer par erreur des pages que vous voulez indexer.
Sommaire
Le rôle réel du robots.txt sur une boutique
Non, le robots.txt ne sert pas à désindexer une page déjà en cache Google : il empêche seulement le crawl, pas l’indexation d’une URL déjà connue par un autre lien. C’est la confusion numéro un que je corrige en audit. Son vrai rôle sur PrestaShop : orienter le budget crawl de Google vers les pages qui comptent (fiches produit, catégories) en écartant les zones techniques et les combinaisons infinies de filtres.
Sur un catalogue de quelques dizaines de références, l’impact reste limité. Sur plusieurs milliers de produits avec navigation à facettes, un robots.txt mal réglé peut faire crawler des milliers d’URLs inutiles chaque semaine, au détriment des pages qui génèrent du chiffre d’affaires.
Ce que génère PrestaShop nativement
Le back-office propose une génération automatique du fichier (Réglages du trafic et SEO), qui couvre déjà l’essentiel : dossiers d’administration, panier, compte client, pages de recherche, comparateur de produits. C’est un bon socle, mais deux limites concrètes :
1. Le fichier peut être régénéré et écraser vos modifications
Une mise à jour de configuration côté PrestaShop régénère parfois le fichier depuis zéro. Si vous avez ajouté des règles manuelles, elles disparaissent. Pensez à les documenter à part pour pouvoir les remettre, ou passez par un module dédié qui persiste les règles.
2. Le multiboutique n’a pas de fichier par boutique
Sur une installation multiboutique, un seul robots.txt s’applique à toutes les boutiques du même nom de domaine racine. Si les boutiques ont des structures d’URL différentes, ce point mérite une vérification manuelle.
Les règles à ajouter sur un catalogue actif
Au-delà du socle natif, voici ce que j’ajoute systématiquement sur une boutique à catalogue moyen ou grand :
- Bloquer les URLs de tri et pagination combinéeLes paramètres comme
?order=ou les combinaisons de filtres multiples génèrent des URLs quasi identiques à la page catégorie mère. UnDisallow: /*?order=ciblé évite le gaspillage de crawl. - Lier le sitemap XML dans le fichierLa ligne
Sitemap: https://votre-domaine.fr/sitemap.xmlen fin de fichier aide Google à découvrir plus vite les nouvelles fiches produit, en complément de la soumission via Search Console. - Étudier les fichiers robots.txt de concurrents directsUn fichier robots.txt est public : consulter ceux de deux ou trois concurrents du même secteur donne souvent des idées de règles à ajouter, notamment sur des pièges spécifiques à un thème PrestaShop partagé.
- Revoir le fichier à chaque ajout de langueUne boutique multilingue peut dupliquer certaines structures d’URL par langue ; vérifiez que les règles couvrent bien tous les préfixes de langue actifs.
Point de vigilance
Ne bloquez jamais au robots.txt une page que vous voulez retirer de l’index : le crawler ne la visite plus, donc ne voit jamais la directive noindex si vous en ajoutez une après coup. Pour désindexer une page déjà connue, utilisez une balise noindex crawlable, ou une suppression via Search Console en complément.
Les erreurs qui coûtent de l’indexation
| Erreur | Conséquence |
|---|---|
Bloquer /modules/ en entier |
Peut bloquer des ressources CSS/JS nécessaires au rendu, donc à l’évaluation mobile-friendly |
| Disallow trop large sur les paramètres | Bloque parfois des URLs de filtre à fort volume de recherche qu’on voulait garder indexables |
| Oublier le sitemap dans le fichier | Découverte plus lente des nouvelles fiches produit |
| Ne pas re-vérifier après une mise à jour PrestaShop | Règles manuelles écrasées silencieusement |
Vérifier et faire vivre le fichier
Le testeur robots.txt de Google Search Console reste l’outil le plus fiable pour confirmer qu’une règle bloque bien l’URL visée, sans effet de bord. Vérifiez-le après chaque modification, pas seulement à la création du fichier. Sur les boutiques à fort trafic, je recommande un contrôle trimestriel : nouveaux modules installés, nouvelles catégories, nouveaux paramètres d’URL ajoutés par une extension marketing peuvent tous créer de nouvelles combinaisons à traiter.
Le robots.txt n’est qu’une pièce du sujet indexation sur PrestaShop : canonicalisation des variantes, gestion de la pagination et lecture du rapport de couverture Search Console complètent la méthode.
Le robots.txt suffit-il à désindexer une page ?
Non. Il empêche seulement le crawl futur. Pour retirer une page déjà indexée, utilisez une balise noindex accessible au crawl, ou une demande de suppression temporaire via Search Console.
Faut-il bloquer les bots d’IA (GPTBot, CCBot) sur une boutique PrestaShop ?
C’est un choix éditorial, pas une obligation SEO : bloquer ces bots ne change rien à votre référencement Google, mais retire vos pages des données d’entraînement de certains modèles. Évaluez selon votre stratégie de visibilité IA.
Le fichier natif de PrestaShop est-il suffisant sur une petite boutique ?
Oui dans la majorité des cas, tant que le catalogue reste modeste et sans navigation à facettes complexe. Les ajustements manuels deviennent utiles à partir de quelques centaines de références ou dès l’apparition de filtres combinables.
Comment éviter que mes règles manuelles soient écrasées ?
Documentez vos règles ajoutées en dehors du back-office, et vérifiez le fichier après chaque mise à jour majeure de PrestaShop ou de module lié au SEO.
Ce qu’il faut retenir
Un robots.txt PrestaShop correct commence par le fichier natif, puis s’enrichit des règles propres à votre catalogue : tri, filtres, sitemap, langues. Ce n’est jamais un sujet qu’on règle une fois pour toutes, surtout sur un catalogue qui évolue. Si vous voulez vérifier l’ensemble de votre indexation, pas seulement ce fichier, mon guide sur l’indexation PrestaShop couvre le sujet dans son ensemble.
À propos de l’auteur
Aymeric Maingé
Consultant SEO senior avec plus de 10 ans d’expérience, côté agence et annonceur. J’accompagne des boutiques PrestaShop et e-commerce sur des problématiques d’indexation, de crawl budget, de performance web et de conversion. Mon approche croise audit terrain, priorisation métier et recommandations actionnables pour les équipes marketing et IT. Votre consultant SEO pour PrestaShop.
Méthodologie utilisée
Cette analyse s’appuie sur le comportement natif du back-office PrestaShop (génération et régénération du robots.txt), sur le benchmark de guides publiés en janvier 2025 et janvier 2022, et sur les recommandations officielles Google concernant le testeur robots.txt de Search Console. Les cas de blocage excessif décrits proviennent d’audits de catalogues PrestaShop réels.
À lire aussi
Les autres articles sur le sujet
Budget de crawl et sitemap ne suffisent pas : la profondeur de clic pilote l’exploration Google d’un catalogue PrestaShop…
Lire l’article
Sur PrestaShop, une page orpheline cache parfois un vrai problème de base de données. Méthode complète pour toutes les détecter et…
Lire l’article
Produit supprimé sur PrestaShop : redirection 301 ou 410, piège de réactivation et méthode pour vérifier que le trafic organique…
Lire l’article
404 et soft 404 sur PrestaShop : comment les identifier, le réglage back-office qui les crée en masse et comment les corriger sans…
Lire l’article
Catégories, produits actifs, ruptures de stock, pages filtrées : le guide complet pour savoir quelles pages PrestaShop indexer,…
Lire l’article
Budget crawl PrestaShop : pourquoi la combinatoire des filtres explose le nombre d’URLs a explorer, et comment le mesurer via les…
Lire l’article
Le noindex a besoin du crawl pour être lu, mais laisse le budget de crawl saigner indéfiniment. La stratégie en deux temps pour…
Lire l’article
Bloquer robots.txt ET noindex sur les mêmes pages : le piège qui annule votre désindexation. La méthode correcte, dans le bon…
Lire l’article
Le statut Decouverte actuellement non indexee touche souvent les gros catalogues PrestaShop : la methode pour distinguer budget…
Lire l’article
Comment générer, segmenter et soumettre un sitemap XML PrestaShop propre : modules, limite de 50 000 URLs, multilangue et erreurs…
Lire l’article
Sitemap mal configuré, doublons de variantes, budget de crawl gaspillé : diagnostic complet des causes de non-indexation des…
Lire l’article

