Un catalogue Shopify entier peut passer sous les 5 % de pages indexées malgré un sitemap propre, des balises index/follow correctes et un robots.txt sans blocage apparent. La cause la plus fréquemment négligée n’est pas dans la configuration SEO, elle est dans la façon dont le thème affiche le contenu au navigateur, et donc à Googlebot.
Reconnaître le symptôme
Sur Shopify, le décalage entre le nombre de pages soumises via le sitemap et le nombre réellement indexé peut être frappant : des boutiques avec plus de 1 500 URLs soumises se retrouvent parfois avec seulement une vingtaine de pages indexées. Ce n’est pas systématiquement un problème de fond, mais quand l’écart persiste sur plusieurs semaines sans amélioration, il indique presque toujours une cause technique précise, pas juste « de la patience à avoir ».
Les causes fréquentes de non-indexation
| Cause | Comment la repérer |
|---|---|
| Budget de crawl limité par rapport au volume de pages | Beaucoup de pages en statut « Découverte, actuellement non indexée » dans Search Console |
| Pages à faible valeur perçue (mentions légales, contact, CGV) | Google les explore mais ne les indexe pas faute d’intérêt éditorial |
| Contenu dupliqué entre variantes produit | Plusieurs URLs très proches sans canonical clair |
| Maillage interne insuffisant | Pages orphelines, atteignables uniquement via le sitemap, jamais liées depuis une page déjà indexée |
| Balise noindex active par erreur | Visible directement dans le code source ou via l’inspection d’URL |
| Contenu affiché uniquement en JavaScript | Voir section suivante, c’est le cas le plus souvent manqué |
L’angle mort : le contenu invisible par JavaScript
C’est la cause la moins documentée dans les guides généralistes sur la non-indexation, alors qu’elle touche spécifiquement les boutiques Shopify qui personnalisent leur thème avec des metafields ou des sections dynamiques chargées après le rendu initial de la page.
Concrètement : un thème Shopify peut afficher une partie du contenu produit (description enrichie, avis, contenu de metafield) via un appel JavaScript exécuté côté client, après le chargement de la page. Si Googlebot ne parvient pas à exécuter ce script correctement, ou s’il évalue la page avant que ce contenu ne s’affiche, il « voit » une page bien plus pauvre que ce qu’un visiteur humain voit réellement. Une page perçue comme quasi-vide ou à faible valeur ajoutée est un candidat direct à la non-indexation, même avec un sitemap et des balises parfaitement configurés par ailleurs.
Dans l’outil d’inspection d’URL de Google Search Console, l’onglet « Aperçu de test en direct » affiche le rendu HTML tel que Googlebot le voit après exécution du JavaScript. Si un texte, un bloc ou une section visible pour un utilisateur normal est absent de cet aperçu, c’est la confirmation directe d’un problème de rendu, pas d’un problème de sitemap ou de balise.
Comment diagnostiquer la vraie cause
- Vérifier le statut exact dans Search Console
La section « Pages » indique la raison précise de chaque exclusion : « Explorée, actuellement non indexée », « Découverte, actuellement non indexée », « Dupliquée sans URL canonique désignée par l’utilisateur », etc. Chaque motif appelle une correction différente.
- Tester le rendu réel avec l’inspection d’URL
Comparer le contenu affiché à un visiteur et celui vu par Googlebot dans l’aperçu de test en direct. Un écart confirme un problème de rendu JavaScript.
- Utiliser la commande site:
site:votredomaine.com/chemin-de-la-pagedonne une indication rapide, mais son absence de résultat ne prouve pas formellement une non-indexation : elle peut simplement refléter un cache de recherche non à jour. - Croiser avec le maillage interne
Vérifier qu’aucune page suspecte n’est orpheline : atteignable uniquement via le sitemap, sans lien entrant depuis une page déjà indexée du site.
Corriger, dans l’ordre
Une fois la cause identifiée, l’ordre de correction compte, en particulier sur un catalogue volumineux :
- Contenu en JavaScript : privilégier un rendu côté serveur pour le contenu essentiel (description produit, prix, disponibilité), et réserver le JavaScript aux éléments réellement interactifs (avis dynamiques, recommandations).
- Pages à faible valeur : les exclure volontairement via noindex plutôt que de les laisser consommer du budget de crawl sans jamais être indexées de toute façon.
- Contenu dupliqué entre variantes : définir une URL canonique claire vers la variante principale du produit.
- Maillage : s’assurer qu’aucune page stratégique ne dépend uniquement du sitemap pour être découverte.
Après chaque correction, une demande d’indexation via l’outil d’inspection d’URL peut accélérer la prise en compte, mais le processus reste itératif : Google recrawle progressivement, pas instantanément, et le suivi doit se faire sur plusieurs semaines plutôt qu’après une seule modification.
Ce que le crawl budget change sur un gros catalogue
Sur une boutique avec plusieurs centaines ou milliers de références, le budget de crawl devient un facteur limitant à part entière : Google ne peut pas visiter l’intégralité des URLs à chaque passage. Concentrer ce budget sur les pages qui comptent réellement (catégories principales, produits à fort potentiel) plutôt que de le laisser se disperser sur des pages secondaires est souvent plus efficace que de multiplier les demandes d’indexation manuelles une par une.
Questions fréquentes
Pourquoi mes pages Shopify ne s’indexent plus depuis un moment précis ?
Une baisse soudaine après une période d’indexation normale pointe souvent vers un changement récent : mise à jour de thème, modification du fichier robots.txt.liquid, ou ajout d’un nouveau bloc de contenu chargé en JavaScript qui masque du contenu auparavant visible statiquement.
Le sitemap suffit-il à faire indexer une page ?
Non. Le sitemap indique à Google qu’une page existe et l’invite à la visiter, mais l’indexation dépend ensuite de la qualité perçue du contenu réellement rendu, du maillage interne et de l’absence de blocage technique.
Comment savoir si mon thème Shopify cache du contenu à Google en JavaScript ?
Utiliser l’aperçu de test en direct dans l’outil d’inspection d’URL de Search Console, et comparer visuellement le rendu affiché à ce que voit un visiteur classique sur la page. Toute absence de texte ou de section indique un problème.
Combien de temps pour voir l’effet d’une correction ?
Ça dépend de la fréquence de crawl habituelle du site. Une demande d’indexation manuelle accélère la vérification sur un échantillon, mais l’ensemble du catalogue suit le rythme naturel de Googlebot, qui peut s’étaler sur plusieurs semaines.
En résumé
Les pages Shopify non indexées ont rarement une cause unique et universelle : sitemap, robots.txt, contenu dupliqué et maillage interne restent les premiers points à vérifier, mais sur les thèmes personnalisés avec des metafields ou des sections dynamiques, le vrai coupable se cache souvent dans le rendu JavaScript, invisible tant qu’on ne compare pas explicitement ce que voit Googlebot à ce que voit un visiteur.
Aymeric Mainge de Lorme
Consultant SEO chez AdTech Paris, j’interviens régulièrement sur des problématiques d’indexation Shopify liées au rendu des thèmes. Pour un diagnostic mené par un consultant qui connaît les spécificités techniques de Shopify, contactez-moi.
À lire aussi
Les autres articles sur le sujet
Shopify verrouille /products/ et /collections/ depuis 2021 : ce qui reste modifiable, les limites des redirections natives et…
Lire l’article
Balise canonical Shopify : pourquoi Shopify duplique vos URLs produits et collections, comment fonctionne le canonical natif, et…
Lire l’article
Shopify bloque déjà une partie du gaspillage de crawl par défaut. Le vrai seuil pour s’en soucier, les fuites qui restent, et…
Lire l’article
Desindexer sur Shopify : les 4 methodes (non liste, seo.hidden, noindex, robots.txt), leur ordre de priorite et comment choisir.
Lire l’article
Le canonical automatique de Shopify ne suffit pas si le maillage interne pointe vers les URLs de collection. La méthode pour…
Lire l’article
Shopify autorise la personnalisation du robots.txt via un template Liquid : la methode, les regles a ne pas casser et comment…
Lire l’article
Comment fonctionne le sitemap XML automatique de Shopify, sa structure en sous-fichiers, ses limites (pas d’édition manuelle) et…
Lire l’article
Configurer Google Search Console sur Shopify : vérification domaine, sitemap, permissions et rapports à surveiller en priorité.
Lire l’article
Search Console, sitemap, canonical produit/collection : la méthode complète pour vérifier et corriger l’indexation d’une boutique…
Lire l’article

