Screaming Frog SEO Spider : auditer son site comme Google le voit

Ce que fait le crawler, ce que la version gratuite permet, les dix analyses à mener sur tout site, les réglages utiles et les cas où un autre outil convient mieux

L’essentiel à retenir

  • Définition : Screaming Frog SEO Spider est un logiciel de bureau (Windows, macOS, Linux) qui explore un site comme un moteur de recherche et liste, pour chaque URL, les éléments qui comptent en SEO : code de réponse, titre, description, H1, canonical, indexabilité, liens, images, vitesse.
  • Prix : gratuit jusqu’à 500 URL par crawl ; licence à 259 € HT par an pour un crawl illimité, les configurations avancées et les connexions API (GA4, Search Console, PageSpeed).
  • Usage : l’outil de l’audit technique, du contrôle avant et après une migration, et du suivi du maillage interne.
  • Limites : une compétence à acquérir, pas de suivi continu, pas de données de positions ni de backlinks.

Screaming Frog SEO Spider est le crawler le plus utilisé par les référenceurs. Installé sur un ordinateur, il parcourt un site en suivant les liens, comme Googlebot, et produit un tableau de toutes les URL avec leurs caractéristiques techniques et éditoriales. C’est l’outil de base de l’audit SEO complet et le contrôle indispensable avant et après une refonte. Ce guide décrit ses fonctions, sa version gratuite, les dix analyses à mener, les réglages et les limites.

Ce que le crawler collecte

FamilleDonnées par URLCe qu’on en fait
RéponseCode HTTP (200, 301, 404, 500), chaîne de redirections, temps de réponseLiens cassés, redirections en chaîne, pages lentes ; voir les codes de réponse HTTP
IndexabilitéIndexable ou non, raison (noindex, canonical vers une autre URL, robots.txt, redirection)Pages importantes non indexables, pages inutiles indexables
BalisesTitle, meta description, H1, H2 (présence, longueur, doublons)Titres manquants, trop longs, dupliqués
ContenuNombre de mots, contenu proche ou dupliqué, lisibilitéPages minces, doublons ; voir le contenu dupliqué
LiensLiens entrants et sortants par page, ancres, profondeur de clic, pages orphelines (avec sitemap ou GA4)Maillage interne ; voir le maillage interne
ImagesPoids, alt manquant, dimensionsImages lourdes, accessibilité
Données structuréesTypes Schema.org détectés, erreurs de validationBalisage manquant ou invalide
Vitesse (avec API PageSpeed)Core Web Vitals de laboratoire et de terrain par URLPages à optimiser ; voir les Core Web Vitals
Rendu JavaScriptDifférences entre HTML brut et renduContenu ou liens invisibles sans JavaScript

Version gratuite et licence

GratuiteLicence (259 € HT / an)
URL par crawl500Illimité (selon la mémoire de l’ordinateur)
Fonctions de baseToutes les analyses du tableau ci-dessusIdem
ConfigurationLimitéeRendu JavaScript, extraction personnalisée, recherche personnalisée, crawl programmé, exclusion et inclusion d’URL
Connexions APINonGA4, Search Console, PageSpeed Insights, Ahrefs, Majestic, Moz, IA (OpenAI, Gemini, Anthropic) pour analyser les contenus
Sauvegarde et comparaison de crawlsNonOui

Pour un site vitrine de moins de 500 pages, la version gratuite suffit à un audit ponctuel. La licence se justifie dès qu’on audite régulièrement, qu’on veut croiser avec la Search Console et GA4, ou qu’on suit une migration.

Les dix analyses à mener sur tout site

  1. Codes de réponse : onglet Response Codes, filtres 4xx et 5xx ; corriger ou rediriger.
  2. Redirections : chaînes et boucles (rapport Redirect Chains) ; une seule redirection vers l’URL finale.
  3. Indexabilité : pages « Non-Indexable » importantes, et pages indexables sans valeur (paramètres, archives).
  4. Titres et descriptions : manquants, dupliqués, trop longs ; filtres de l’onglet Page Titles et Meta Description.
  5. H1 : manquants, multiples, identiques au titre partout.
  6. Canonicals : absents, vers une URL non indexable, incohérents.
  7. Profondeur de clic : pages stratégiques à plus de 3 clics ; onglet Crawl Depth.
  8. Pages orphelines : URL du sitemap ou de GA4 absentes du crawl (mode Crawl Analysis avec sitemap connecté).
  9. Images : alt manquants et poids supérieur à 200 Ko ; voir l’indexation des images.
  10. Contenu mince et proche : pages de moins de 300 mots, doublons proches (Near Duplicates).

Exportez chaque onglet en CSV et regroupez les corrections par gabarit : une correction de modèle règle des dizaines d’URL d’un coup.

Réglages utiles

  • Mode Spider pour explorer depuis l’accueil ; mode List pour vérifier une liste d’URL (table de redirections, sitemap).
  • Rendu JavaScript (Configuration, Spider, Rendering) pour les sites en React, Vue ou Angular ; plus lent, indispensable.
  • Vitesse de crawl réduite (2 à 5 URL par seconde) pour ne pas surcharger un petit hébergement.
  • User-agent Googlebot pour voir ce que Google voit, en respectant le robots.txt.
  • Connexion Search Console et GA4 pour ajouter clics, impressions et sessions à chaque URL : les pages sans trafic ni impression sont candidates à la fusion ou à la suppression.
  • Extraction personnalisée (XPath, regex) pour vérifier la présence d’un élément sur toutes les pages : balise de consentement, prix, auteur.
  • Comparaison de crawls avant et après une modification ou une migration.

Limites et alternatives

LimiteAlternative ou complément
Outil de bureau, ponctuel, pas de surveillance continueCrawlers en ligne avec suivi (Sitebulb Cloud, Oncrawl, Lumar) ou module de santé de site d’une plateforme de pilotage
Grands sites (plus de 500 000 URL) limités par la mémoireMode base de données de Screaming Frog, ou crawlers cloud
Pas de positions, de mots-clés ni de backlinksSearch Console, Monitorank, Ahrefs, Majestic ; voir Majestic SEO
Compétence à acquérirSitebulb (plus guidé, à partir de 13 £ par mois) pour les débutants
Ne voit que ce qui est liéConnecter le sitemap et GA4 pour les orphelines
Conseil : lancez un crawl gratuit de votre site aujourd’hui et regardez trois onglets : Response Codes (4xx), Page Titles (Duplicate et Missing) et Directives (Noindex). En vingt minutes, vous aurez la liste des problèmes techniques qui pénalisent le site depuis des mois, sans dépenser un euro.

Comment GreenRed vous aide

Plutôt que de jongler entre plusieurs outils, le module Santé du site de GreenRed réunit ces indicateurs dans un seul tableau de bord, les compare dans le temps et vous indique les actions prioritaires. Vous pouvez le tester gratuitement, sans carte bancaire, depuis la page Tarifs.

Questions fréquentes

Screaming Frog est-il gratuit ?

La version gratuite explore jusqu’à 500 URL par crawl avec toutes les analyses de base, ce qui suffit pour un site vitrine. La licence, 259 € HT par an, lève la limite et ajoute le rendu JavaScript, les connexions API (Search Console, GA4, PageSpeed), l’extraction personnalisée, la sauvegarde et la comparaison de crawls.

Screaming Frog remplace-t-il Semrush ou Ahrefs ?

Non : il couvre l’audit technique et le maillage (ce que les suites font moins bien), mais ne fournit ni positions, ni mots-clés, ni backlinks. Il se combine avec la Search Console (gratuite) pour les positions et avec un outil de backlinks pour le netlinking.

Faut-il activer le rendu JavaScript ?

Oui si le site est construit avec un framework JavaScript (React, Vue, Angular, Next.js en rendu client) ou charge des contenus et des liens en JavaScript. Le crawl est plus lent, mais il montre ce que Google indexe réellement. Pour un site WordPress ou statique classique, le crawl HTML suffit.

À quelle fréquence crawler son site ?

Après chaque mise en ligne importante (refonte, migration, nouveau gabarit) et au moins une fois par trimestre pour un site vivant. Les sites qui publient beaucoup ou changent souvent gagnent à ajouter une surveillance continue par un crawler cloud ou un module de santé de site.

Centralisez vos outils marketing

GreenRed connecte vos outils Google et sociaux et vous offre une vue unifiée de vos performances.

Essayer GreenRed

Articles connexes