Wix et le budget de crawl : optimiser robots.txt, sitemap et noindex pour Googlebot

Niveau de lectureAvancé
CMS / OutilWix
Temps de lecture7 min

Sur Wix, on dispose de trois leviers pour piloter le budget de crawl : le sitemap, le noindex et le robots.txt. Le piège n’est pas de mal régler l’un d’eux, c’est de les combiner dans le mauvais ordre. Un noindex posé sur une page déjà bloquée au crawl ne sera jamais lu, et Wix ne vous laissera pas revenir en arrière facilement.

Le budget de crawl sur Wix, de quoi on parle

Le budget de crawl est le nombre d’URL que Googlebot explore sur votre site dans un intervalle donné. Il dépend de deux facteurs : la capacité d’exploration, liée au temps de réponse du serveur, et la demande d’exploration, liée à la fraîcheur et à l’autorité du site. Sur Wix, vous ne pilotez pas le temps de réponse : il reste à agir sur le nombre d’URL proposées à l’exploration.

Le sujet devient concret à partir de quelques centaines d’URL indexables. Sur un site Wix, ce sont surtout Wix Stores et Wix Bookings qui gonflent le volume, avec des URL à paramètres, des catégories vides et des pages sans créneau. Ce diagnostic préalable est détaillé dans notre article sur l’audit du budget de crawl sans logs serveur.

Levier 1, le sitemap : le plus sûr sur Wix

C’est le levier à privilégier, parce qu’il est réversible et sans effet de bord. Wix génère automatiquement un sitemap scindé par type : un index, plus un sitemap des pages, un des articles, un des produits. La régénération prend 24 à 48 heures après une modification.

Pour retirer une page du sitemap, ouvrez ses paramètres SEO et décochez « Inclure cette page dans le sitemap ». Bons candidats : pages de remerciement, pages de confirmation, pages de test, pages trop fines pour se classer, pages de destination publicitaires qui n’ont pas vocation à être trouvées dans les résultats. Retirer une page du sitemap ne la désindexe pas si elle est déjà connue, mais elle cesse d’être poussée activement vers Google.

Levier 2, le noindex : par page, pas en masse

Le noindex est la seule mesure qui retire vraiment une page de l’index. Il se pose page par page, dans les paramètres SEO, via l’option « balise meta pour les robots Noindex ». Wix l’applique déjà automatiquement aux pages d’archive du blog, aux pages de mots-clés, aux pages membres et aux pages protégées par mot de passe.

Il n’existe aucun outil pour traiter plusieurs pages d’un coup. Sur un gros site, cela oblige à prioriser : on commence par les gabarits qui génèrent le plus d’URL sans valeur, catégories Stores redondantes, pages Bookings sans enjeu, avant de descendre dans le détail.

Levier 3, le robots.txt : puissant et dangereux

Depuis 2026, le robots.txt de Wix est éditable depuis Paramètres, SEO, Robots.txt. Wix y bloque déjà par défaut les chemins internes /_api/, /_partials/ et /_files/. Vous pouvez ajouter des règles Disallow, typiquement sur des paramètres d’URL de Wix Stores.

Trois avertissements. L’application d’une nouvelle règle prend 24 à 72 heures côté Google. Wix précise que son support ne peut pas vous dépanner en cas de problème causé par une modification du robots.txt, comme détaillé dans notre article sur ce qui est modifiable dans le robots.txt de Wix. Et surtout : une URL bloquée par robots.txt continue de consommer une fraction du budget de crawl, et peut rester indexée si un lien pointe vers elle, sans description puisque Google n’a plus le droit de lire la page.

L’ordre qui évite la catastrophe

Voilà le point que presque tout le monde manque. Le noindex et le Disallow robots.txt s’annulent : une page bloquée au crawl ne peut jamais faire lire son noindex à Google, elle reste donc indexée indéfiniment, sans snippet, sans moyen simple de la sortir. Sur Wix, où l’on ne peut pas annuler rapidement un blocage robots.txt et où le support ne suit pas, l’erreur coûte cher.

La séquence sûre : d’abord le noindex sur la page, on attend qu’elle sorte de l’index, on le vérifie, puis seulement on ajoute un Disallow robots.txt pour économiser le crawl. Jamais l’inverse. Et pour les paramètres d’URL, le canonique natif de Wix est préférable au robots.txt : il consolide les signaux vers l’URL propre au lieu de simplement masquer la variante.

Optimiser le crawl sur Wix dans le bon ordre

  1. Cartographier les URL inutilesRapport Statistiques d’exploration et rapport Pages : repérer 404, doublons, soft 404, gabarits qui génèrent trop d’URL.
  2. Nettoyer le sitemap en premierDécocher « Inclure cette page dans le sitemap » sur les pages de remerciement, de test, de destination publicitaire et trop fines.
  3. Poser le noindex sur les pages à sortir de l’indexPar page, option « balise meta pour les robots Noindex », en commençant par les gabarits les plus prolifiques.
  4. Attendre la désindexation avant de bloquerVérifier dans le rapport Pages que les URL sont bien sorties, seulement ensuite passer au robots.txt.
  5. Ajouter les règles robots.txt avec prudenceParamètres, SEO, Robots.txt ; cibler les paramètres exacts ; se souvenir que le support Wix ne dépanne pas.
  6. Traiter les paramètres d’URL par le canoniqueLe canonique natif de Wix consolide les signaux ; le robots.txt ne fait que cacher.

Trois leviers, une séquence

Optimiser le budget de crawl sur Wix, c’est utiliser les trois leviers dans l’ordre : nettoyer le sitemap parce que c’est réversible, poser les noindex parce que c’est le seul moyen de désindexer, et n’ajouter les Disallow robots.txt qu’une fois la désindexation acquise. Inverser noindex et robots.txt crée des pages coincées dans l’index, et sur Wix on ne revient pas facilement en arrière.

À propos de l’auteur

Aymeric Maingé

Consultant SEO senior avec plus de 10 ans d’expérience, côté agence et annonceur. J’accompagne des sites Wix sur des problématiques de budget de crawl, d’indexation, de sitemap et de robots.txt, avec les garde-fous propres à la plateforme. Mon approche croise audit terrain, priorisation métier et recommandations actionnables pour les équipes marketing et IT. Pour piloter votre crawl avec un expert en référencement naturel pour Wix, parlons de votre site.

Peut-on modifier le robots.txt d’un site Wix ?

Oui, depuis 2026, via Paramètres, SEO, Robots.txt, sur un domaine personnalisé. Wix y bloque déjà /_api/, /_partials/ et /_files/. L’application d’une nouvelle règle prend 24 à 72 heures, et le support Wix ne dépanne pas en cas d’erreur.

Dans quel ordre appliquer noindex et robots.txt sur Wix ?

D’abord le noindex sur la page, le temps que Google la sorte de l’index. Le Disallow robots.txt vient seulement après. Bloquer au crawl une page encore indexée empêche Google de lire le noindex : la page reste dans l’index, sans description.

Retirer une page du sitemap Wix la désindexe-t-elle ?

Non. Décocher « Inclure cette page dans le sitemap » arrête de la pousser activement vers Google, mais si elle est déjà indexée ou liée ailleurs, elle reste dans l’index. Pour la retirer, il faut un noindex.

Faut-il bloquer les paramètres d’URL via robots.txt sur Wix ?

Le canonique natif de Wix est préférable : il consolide les signaux vers l’URL propre. Le robots.txt ne fait que masquer la variante, sans transférer sa valeur, et l’URL bloquée consomme quand même une part du budget de crawl.

Combien de temps pour voir l’effet d’un nettoyage de crawl sur Wix ?

Le sitemap se régénère sous 24 à 48 heures, les règles robots.txt s’appliquent sous 24 à 72 heures côté Google, et les premières variations de crawl s’observent sur deux à quatre semaines, avec un effet stabilisé vers un à deux mois.

Le robots.txt Wix fonctionne-t-il sur une adresse wixsite.com ?

Non. La personnalisation du robots.txt de Wix suppose un domaine personnalisé connecté. Sur une adresse gratuite wixsite.com, vous n’avez pas la main dessus.

À lire aussi

Les autres articles sur le sujet

Aymeric Maingé consultant SEO freelance