Comment configurer le fichier robots.txt sur PrestaShop pour le SEO ?

PrestaShop génère un robots.txt correct par défaut, mais un catalogue qui grossit crée vite des URLs à bloquer que le fichier natif ne couvre pas : filtres, paramètres de tri, pages de recherche interne. Voici comment le configurer proprement, sans risquer de bloquer par erreur des pages que vous voulez indexer.

Niveau de lectureIntermédiaire
CMS / OutilPrestaShop
Temps de lecture4 min

Le rôle réel du robots.txt sur une boutique

Non, le robots.txt ne sert pas à désindexer une page déjà en cache Google : il empêche seulement le crawl, pas l’indexation d’une URL déjà connue par un autre lien. C’est la confusion numéro un que je corrige en audit. Son vrai rôle sur PrestaShop : orienter le budget crawl de Google vers les pages qui comptent (fiches produit, catégories) en écartant les zones techniques et les combinaisons infinies de filtres.

Sur un catalogue de quelques dizaines de références, l’impact reste limité. Sur plusieurs milliers de produits avec navigation à facettes, un robots.txt mal réglé peut faire crawler des milliers d’URLs inutiles chaque semaine, au détriment des pages qui génèrent du chiffre d’affaires.

Ce que génère PrestaShop nativement

Le back-office propose une génération automatique du fichier (Réglages du trafic et SEO), qui couvre déjà l’essentiel : dossiers d’administration, panier, compte client, pages de recherche, comparateur de produits. C’est un bon socle, mais deux limites concrètes :

1. Le fichier peut être régénéré et écraser vos modifications

Une mise à jour de configuration côté PrestaShop régénère parfois le fichier depuis zéro. Si vous avez ajouté des règles manuelles, elles disparaissent. Pensez à les documenter à part pour pouvoir les remettre, ou passez par un module dédié qui persiste les règles.

2. Le multiboutique n’a pas de fichier par boutique

Sur une installation multiboutique, un seul robots.txt s’applique à toutes les boutiques du même nom de domaine racine. Si les boutiques ont des structures d’URL différentes, ce point mérite une vérification manuelle.

Les règles à ajouter sur un catalogue actif

Au-delà du socle natif, voici ce que j’ajoute systématiquement sur une boutique à catalogue moyen ou grand :

  1. Bloquer les URLs de tri et pagination combinéeLes paramètres comme ?order= ou les combinaisons de filtres multiples génèrent des URLs quasi identiques à la page catégorie mère. Un Disallow: /*?order= ciblé évite le gaspillage de crawl.
  2. Lier le sitemap XML dans le fichierLa ligne Sitemap: https://votre-domaine.fr/sitemap.xml en fin de fichier aide Google à découvrir plus vite les nouvelles fiches produit, en complément de la soumission via Search Console.
  3. Étudier les fichiers robots.txt de concurrents directsUn fichier robots.txt est public : consulter ceux de deux ou trois concurrents du même secteur donne souvent des idées de règles à ajouter, notamment sur des pièges spécifiques à un thème PrestaShop partagé.
  4. Revoir le fichier à chaque ajout de langueUne boutique multilingue peut dupliquer certaines structures d’URL par langue ; vérifiez que les règles couvrent bien tous les préfixes de langue actifs.

Point de vigilance

Ne bloquez jamais au robots.txt une page que vous voulez retirer de l’index : le crawler ne la visite plus, donc ne voit jamais la directive noindex si vous en ajoutez une après coup. Pour désindexer une page déjà connue, utilisez une balise noindex crawlable, ou une suppression via Search Console en complément.

Les erreurs qui coûtent de l’indexation

Erreur Conséquence
Bloquer /modules/ en entier Peut bloquer des ressources CSS/JS nécessaires au rendu, donc à l’évaluation mobile-friendly
Disallow trop large sur les paramètres Bloque parfois des URLs de filtre à fort volume de recherche qu’on voulait garder indexables
Oublier le sitemap dans le fichier Découverte plus lente des nouvelles fiches produit
Ne pas re-vérifier après une mise à jour PrestaShop Règles manuelles écrasées silencieusement

Vérifier et faire vivre le fichier

Le testeur robots.txt de Google Search Console reste l’outil le plus fiable pour confirmer qu’une règle bloque bien l’URL visée, sans effet de bord. Vérifiez-le après chaque modification, pas seulement à la création du fichier. Sur les boutiques à fort trafic, je recommande un contrôle trimestriel : nouveaux modules installés, nouvelles catégories, nouveaux paramètres d’URL ajoutés par une extension marketing peuvent tous créer de nouvelles combinaisons à traiter.

Le robots.txt n’est qu’une pièce du sujet indexation sur PrestaShop : canonicalisation des variantes, gestion de la pagination et lecture du rapport de couverture Search Console complètent la méthode.

Le robots.txt suffit-il à désindexer une page ?

Non. Il empêche seulement le crawl futur. Pour retirer une page déjà indexée, utilisez une balise noindex accessible au crawl, ou une demande de suppression temporaire via Search Console.

Faut-il bloquer les bots d’IA (GPTBot, CCBot) sur une boutique PrestaShop ?

C’est un choix éditorial, pas une obligation SEO : bloquer ces bots ne change rien à votre référencement Google, mais retire vos pages des données d’entraînement de certains modèles. Évaluez selon votre stratégie de visibilité IA.

Le fichier natif de PrestaShop est-il suffisant sur une petite boutique ?

Oui dans la majorité des cas, tant que le catalogue reste modeste et sans navigation à facettes complexe. Les ajustements manuels deviennent utiles à partir de quelques centaines de références ou dès l’apparition de filtres combinables.

Comment éviter que mes règles manuelles soient écrasées ?

Documentez vos règles ajoutées en dehors du back-office, et vérifiez le fichier après chaque mise à jour majeure de PrestaShop ou de module lié au SEO.

Ce qu’il faut retenir

Un robots.txt PrestaShop correct commence par le fichier natif, puis s’enrichit des règles propres à votre catalogue : tri, filtres, sitemap, langues. Ce n’est jamais un sujet qu’on règle une fois pour toutes, surtout sur un catalogue qui évolue. Si vous voulez vérifier l’ensemble de votre indexation, pas seulement ce fichier, mon guide sur l’indexation PrestaShop couvre le sujet dans son ensemble.

À propos de l’auteur

Aymeric Maingé

Consultant SEO senior avec plus de 10 ans d’expérience, côté agence et annonceur. J’accompagne des boutiques PrestaShop et e-commerce sur des problématiques d’indexation, de crawl budget, de performance web et de conversion. Mon approche croise audit terrain, priorisation métier et recommandations actionnables pour les équipes marketing et IT. Votre consultant SEO pour PrestaShop.

Méthodologie utilisée

Cette analyse s’appuie sur le comportement natif du back-office PrestaShop (génération et régénération du robots.txt), sur le benchmark de guides publiés en janvier 2025 et janvier 2022, et sur les recommandations officielles Google concernant le testeur robots.txt de Search Console. Les cas de blocage excessif décrits proviennent d’audits de catalogues PrestaShop réels.

À lire aussi

Les autres articles sur le sujet

Aymeric Maingé consultant SEO freelance