Screaming Frog révèle des centaines de problèmes potentiels sur un site, mais un audit technique n’a pas besoin de tous les traiter pour être utile : une poignée de rapports concentre l’essentiel des découvertes exploitables. Voici lesquels, comment les lire vite, et la méthode qui évite de reconfigurer l’outil à chaque nouveau client, un enjeu central quand l’audit est facturé au forfait.
- Ce que veut dire « 80 % des problèmes » avec Screaming Frog
- Les cinq rapports qui concentrent l’essentiel
- Le réglage de départ qui change tout
- Construire une configuration réutilisable, pas repartir de zéro à chaque client
- Prioriser les résultats sans y passer la journée
- Ce que Screaming Frog ne voit pas
- Questions fréquentes
Ce que veut dire « 80 % des problèmes » avec Screaming Frog
Screaming Frog peut afficher plusieurs centaines de colonnes et de filtres différents sur un crawl de taille moyenne. La plupart ne remontent jamais rien d’actionnable sur un site donné. Le principe de Pareto appliqué ici n’est pas une formule marketing : sur la grande majorité des sites audités, cinq familles de rapports concentrent l’essentiel des découvertes qui changent réellement un plan d’action, tandis que les dizaines d’autres onglets restent silencieux ou ne remontent que du bruit propre au site. Notre méthodologie complète d’audit SEO technique détaille l’ensemble des quatre piliers d’un audit ; cet article se concentre sur l’outil qui exécute concrètement le premier d’entre eux, l’indexation et le crawl.
Les cinq rapports qui concentrent l’essentiel
Response Codes : les erreurs qui cassent l’expérience et le crawl
L’onglet Response Codes, filtré sur Client Error (4xx) et Server Error (5xx), liste toutes les pages en erreur. Les redirections en chaîne (plusieurs 301 successives avant d’atteindre la page finale) méritent un filtre séparé : elles gaspillent du budget de crawl et diluent l’autorité transmise à chaque saut.
Page Titles et Meta Description : les doublons qui diluent le signal
Le filtre « Duplicate » de ces deux onglets révèle les balises identiques ou quasi identiques sur plusieurs URLs, souvent un symptôme de pages générées automatiquement (variantes produit, filtres, pagination) sans logique de personnalisation.
Crawl Depth : la distance qui prédit l’exploration
La colonne Crawl Depth, triée par ordre décroissant, isole en quelques secondes les pages les plus difficiles à atteindre depuis l’accueil. Croisée avec le nombre de liens entrants internes (Inlinks), elle distingue une page profonde mais bien reliée d’une page profonde et quasi invisible.
Inlinks et Orphan URLs : le maillage réel, pas celui qu’on imagine
Le rapport Orphan URLs (généré en croisant le crawl avec le sitemap XML ou une source Analytics/Search Console) révèle les pages qu’aucun lien interne n’atteint : elles existent, sont parfois même indexées, mais Screaming Frog ne les aurait jamais trouvées par simple navigation.
Canonicals : la source de vérité contredite ou absente
Le filtre « Canonicalised » et « Missing » révèle les pages sans balise canonique déclarée ou avec une balise qui pointe vers une autre URL que celle crawlée, un signal fréquent de duplication mal gérée ou de migration incomplète.
Le réglage de départ qui change tout
Avant de lancer le moindre crawl, deux réglages conditionnent la fiabilité de tout ce qui suit. Le user-agent doit être positionné sur Googlebot (Smartphone, puisque l’index mobile-first est la norme) pour que le crawl reflète ce que Google voit réellement, pas ce qu’un navigateur standard afficherait. Le mode de stockage (Database Storage plutôt que Memory Storage) s’impose dès qu’un site dépasse quelques milliers d’URLs : la mémoire vive sature vite et le crawl peut planter à mi-parcours, ce qui oblige à tout relancer sur un audit déjà entamé.
Construire une configuration réutilisable, pas repartir de zéro à chaque client
C’est le point que les tutoriels génériques passent sous silence, alors qu’il pèse directement sur la rentabilité d’un audit facturé au forfait : reconfigurer Screaming Frog de zéro (user-agent, exclusions, extractions personnalisées, colonnes affichées) à chaque nouveau client coûte du temps qui ne se facture nulle part, puisque le client paie pour le résultat de l’audit, pas pour son paramétrage.
Le fichier de configuration, la brique qui règle le problème
Screaming Frog permet de sauvegarder un jeu de réglages complet dans un fichier .seospiderconfig via Config > Profiles > Save As, puis de le recharger instantanément sur n’importe quel nouveau crawl via Config > Profiles > Load. Une option complémentaire, Config > Profiles > Save Current Configuration As Default, applique automatiquement ce jeu de réglages à chaque nouveau crawl lancé, sans même avoir à le recharger manuellement.
Ce qu’il faut mettre dans cette configuration type
Le user-agent Googlebot Smartphone, le mode Database Storage activé par défaut, les exclusions courantes (paramètres de tracking, pages de recherche interne, panier), et des extractions personnalisées si vous vérifiez systématiquement les mêmes éléments (présence d’un balisage schema.org précis, d’un identifiant Analytics) sur chaque site audité. Une fois ce socle posé, seule la liste d’exclusions spécifique au site en cours reste à ajuster, en quelques minutes plutôt qu’en une demi-heure de reparamétrage complet.
Le gain réel sur un forfait audit
Sur un audit facturé un ou deux jours, chaque demi-heure de reconfiguration récurrente représente un pourcentage significatif du temps total facturable. Industrialiser ce point n’améliore pas la qualité de l’audit lui-même, mais préserve la marge sur un forfait à prix fixe et libère du temps pour la partie qui a réellement de la valeur pour le client : l’interprétation des résultats et la priorisation du plan d’action.
Prioriser les résultats sans y passer la journée
Exporter chaque rapport en CSV pour le trier manuellement dans un tableur consomme un temps disproportionné par rapport à la valeur ajoutée. Une méthode plus rapide consiste à croiser directement dans Screaming Frog les erreurs détectées avec les données de trafic organique (via l’intégration Search Console native, activable dans Configuration > API Access) : une page en erreur 404 sans aucun trafic organique historique n’a pas la même urgence qu’une page en erreur qui recevait des visites avant de casser. Ce croisement, natif à l’outil, évite un export supplémentaire et une manipulation dans un tableur externe.
Ce que Screaming Frog ne voit pas
Screaming Frog cartographie la structure technique d’un site, mais ne mesure ni le trafic réel, ni les positions, ni la qualité éditoriale d’un contenu. Un audit technique complet croise systématiquement ses résultats avec Search Console (indexation réelle, requêtes qui génèrent du trafic) et Google Analytics (comportement des visiteurs sur les pages identifiées comme problématiques), pour transformer une liste d’erreurs techniques en priorités qui reflètent un enjeu business, pas seulement un défaut détecté par un robot.
Questions fréquentes
La version gratuite de Screaming Frog suffit-elle pour un audit professionnel ?
Elle limite le crawl à 500 URLs, ce qui suffit pour un petit site vitrine mais devient vite insuffisant sur un site de contenu ou un catalogue e-commerce. Au-delà, la licence payante annuelle reste rentable dès le premier audit facturé sur un site de taille moyenne.
Comment sauvegarder et réutiliser une configuration Screaming Frog d’un audit à l’autre ?
Via le menu Config > Profiles > Save As pour créer un fichier de configuration réutilisable, puis Config > Profiles > Load pour le recharger sur un nouveau crawl. L’option Save Current Configuration As Default applique automatiquement ce réglage à chaque nouveau crawl sans rechargement manuel.
Faut-il crawler tout le site ou se limiter à un échantillon ?
Sur un site volumineux, un crawl complet reste préférable pour ne pas manquer de pages orphelines ou d’erreurs isolées, à condition d’activer le stockage en base de données plutôt qu’en mémoire vive pour éviter les plantages en cours de crawl.
Screaming Frog suffit-il seul pour un audit technique complet ?
Non. Il cartographie la structure technique mais ne mesure ni le trafic, ni les positions, ni la qualité du contenu. Un audit complet croise systématiquement ses résultats avec Search Console et Analytics pour prioriser selon l’impact business réel, pas seulement le nombre d’erreurs détectées.
En résumé
Cinq rapports (erreurs HTTP, doublons de balises, profondeur de crawl, maillage et pages orphelines, canonicals) concentrent l’essentiel des découvertes exploitables d’un audit Screaming Frog. Le réglage initial (user-agent, mode de stockage) conditionne leur fiabilité, mais c’est la configuration réutilisable, sauvegardée une fois et rechargée à chaque nouveau client, qui fait la différence sur la rentabilité réelle d’un audit facturé au forfait.
À propos de l’auteur
Aymeric Maingé
Consultant SEO senior avec plus de 10 ans d’expérience, côté agence et annonceur, aujourd’hui en freelance. J’audite des sites de toutes tailles sur les problématiques d’indexation, de crawl et de maillage interne, avec une méthode outillée pensée pour rester rentable sur un forfait audit. Mon approche croise audit terrain, priorisation métier et recommandations actionnables pour les équipes marketing et IT. Pour un freelance SEO qui a industrialisé sa méthode d’audit technique, site après site, parlons de votre projet.
À lire aussi
Les autres articles sur le sujet
Pages orphelines : comment les détecter avec Screaming Frog et les logs, puis prioriser leur correction avec la grille trafic x…
Lire l’article
Sitemap XML : le créer, l’optimiser, l’envoyer à Google, et le test des 30 secondes pour savoir si votre lastmod a encore de la…
Lire l’article
Fichier robots.txt : syntaxe exacte, ce qui se passe vraiment en cas d’erreur 404 ou panne serveur, robots IA, et les erreurs qui…
Lire l’article
Erreurs canonical les plus fréquentes et, surtout, l’ordre pour les corriger sur un audit à temps limité. Grille de triage par…
Lire l’article
Pages non indexées sur Google : la différence entre Détectée et Explorée non indexée change tout sur la correction à appliquer.…
Lire l’article
Search Console ne montre pas tout. Les logs serveur révèlent le vrai gaspillage de crawl et les pages orphelines qu’un crawl…
Lire l’article
Capacité vs demande de crawl, erreurs qui gaspillent du budget, et la formule pour chiffrer ce gaspillage, que la plupart des…
Lire l’article

