L’essentiel à retenir
- Définition : Screaming Frog SEO Spider est un logiciel de bureau (Windows, macOS, Linux) qui explore un site comme un moteur de recherche et liste, pour chaque URL, les éléments qui comptent en SEO : code de réponse, titre, description, H1, canonical, indexabilité, liens, images, vitesse.
- Prix : gratuit jusqu’à 500 URL par crawl ; licence à 259 € HT par an pour un crawl illimité, les configurations avancées et les connexions API (GA4, Search Console, PageSpeed).
- Usage : l’outil de l’audit technique, du contrôle avant et après une migration, et du suivi du maillage interne.
- Limites : une compétence à acquérir, pas de suivi continu, pas de données de positions ni de backlinks.
Screaming Frog SEO Spider est le crawler le plus utilisé par les référenceurs. Installé sur un ordinateur, il parcourt un site en suivant les liens, comme Googlebot, et produit un tableau de toutes les URL avec leurs caractéristiques techniques et éditoriales. C’est l’outil de base de l’audit SEO complet et le contrôle indispensable avant et après une refonte. Ce guide décrit ses fonctions, sa version gratuite, les dix analyses à mener, les réglages et les limites.
Ce que le crawler collecte
| Famille | Données par URL | Ce qu’on en fait |
|---|---|---|
| Réponse | Code HTTP (200, 301, 404, 500), chaîne de redirections, temps de réponse | Liens cassés, redirections en chaîne, pages lentes ; voir les codes de réponse HTTP |
| Indexabilité | Indexable ou non, raison (noindex, canonical vers une autre URL, robots.txt, redirection) | Pages importantes non indexables, pages inutiles indexables |
| Balises | Title, meta description, H1, H2 (présence, longueur, doublons) | Titres manquants, trop longs, dupliqués |
| Contenu | Nombre de mots, contenu proche ou dupliqué, lisibilité | Pages minces, doublons ; voir le contenu dupliqué |
| Liens | Liens entrants et sortants par page, ancres, profondeur de clic, pages orphelines (avec sitemap ou GA4) | Maillage interne ; voir le maillage interne |
| Images | Poids, alt manquant, dimensions | Images lourdes, accessibilité |
| Données structurées | Types Schema.org détectés, erreurs de validation | Balisage manquant ou invalide |
| Vitesse (avec API PageSpeed) | Core Web Vitals de laboratoire et de terrain par URL | Pages à optimiser ; voir les Core Web Vitals |
| Rendu JavaScript | Différences entre HTML brut et rendu | Contenu ou liens invisibles sans JavaScript |
Version gratuite et licence
| Gratuite | Licence (259 € HT / an) | |
|---|---|---|
| URL par crawl | 500 | Illimité (selon la mémoire de l’ordinateur) |
| Fonctions de base | Toutes les analyses du tableau ci-dessus | Idem |
| Configuration | Limitée | Rendu JavaScript, extraction personnalisée, recherche personnalisée, crawl programmé, exclusion et inclusion d’URL |
| Connexions API | Non | GA4, Search Console, PageSpeed Insights, Ahrefs, Majestic, Moz, IA (OpenAI, Gemini, Anthropic) pour analyser les contenus |
| Sauvegarde et comparaison de crawls | Non | Oui |
Pour un site vitrine de moins de 500 pages, la version gratuite suffit à un audit ponctuel. La licence se justifie dès qu’on audite régulièrement, qu’on veut croiser avec la Search Console et GA4, ou qu’on suit une migration.
Les dix analyses à mener sur tout site
- Codes de réponse : onglet Response Codes, filtres 4xx et 5xx ; corriger ou rediriger.
- Redirections : chaînes et boucles (rapport Redirect Chains) ; une seule redirection vers l’URL finale.
- Indexabilité : pages « Non-Indexable » importantes, et pages indexables sans valeur (paramètres, archives).
- Titres et descriptions : manquants, dupliqués, trop longs ; filtres de l’onglet Page Titles et Meta Description.
- H1 : manquants, multiples, identiques au titre partout.
- Canonicals : absents, vers une URL non indexable, incohérents.
- Profondeur de clic : pages stratégiques à plus de 3 clics ; onglet Crawl Depth.
- Pages orphelines : URL du sitemap ou de GA4 absentes du crawl (mode Crawl Analysis avec sitemap connecté).
- Images : alt manquants et poids supérieur à 200 Ko ; voir l’indexation des images.
- Contenu mince et proche : pages de moins de 300 mots, doublons proches (Near Duplicates).
Exportez chaque onglet en CSV et regroupez les corrections par gabarit : une correction de modèle règle des dizaines d’URL d’un coup.
Réglages utiles
- Mode Spider pour explorer depuis l’accueil ; mode List pour vérifier une liste d’URL (table de redirections, sitemap).
- Rendu JavaScript (Configuration, Spider, Rendering) pour les sites en React, Vue ou Angular ; plus lent, indispensable.
- Vitesse de crawl réduite (2 à 5 URL par seconde) pour ne pas surcharger un petit hébergement.
- User-agent Googlebot pour voir ce que Google voit, en respectant le robots.txt.
- Connexion Search Console et GA4 pour ajouter clics, impressions et sessions à chaque URL : les pages sans trafic ni impression sont candidates à la fusion ou à la suppression.
- Extraction personnalisée (XPath, regex) pour vérifier la présence d’un élément sur toutes les pages : balise de consentement, prix, auteur.
- Comparaison de crawls avant et après une modification ou une migration.
Limites et alternatives
| Limite | Alternative ou complément |
|---|---|
| Outil de bureau, ponctuel, pas de surveillance continue | Crawlers en ligne avec suivi (Sitebulb Cloud, Oncrawl, Lumar) ou module de santé de site d’une plateforme de pilotage |
| Grands sites (plus de 500 000 URL) limités par la mémoire | Mode base de données de Screaming Frog, ou crawlers cloud |
| Pas de positions, de mots-clés ni de backlinks | Search Console, Monitorank, Ahrefs, Majestic ; voir Majestic SEO |
| Compétence à acquérir | Sitebulb (plus guidé, à partir de 13 £ par mois) pour les débutants |
| Ne voit que ce qui est lié | Connecter le sitemap et GA4 pour les orphelines |
Comment GreenRed vous aide
Plutôt que de jongler entre plusieurs outils, le module Santé du site de GreenRed réunit ces indicateurs dans un seul tableau de bord, les compare dans le temps et vous indique les actions prioritaires. Vous pouvez le tester gratuitement, sans carte bancaire, depuis la page Tarifs.
Questions fréquentes
Screaming Frog est-il gratuit ?
La version gratuite explore jusqu’à 500 URL par crawl avec toutes les analyses de base, ce qui suffit pour un site vitrine. La licence, 259 € HT par an, lève la limite et ajoute le rendu JavaScript, les connexions API (Search Console, GA4, PageSpeed), l’extraction personnalisée, la sauvegarde et la comparaison de crawls.
Screaming Frog remplace-t-il Semrush ou Ahrefs ?
Non : il couvre l’audit technique et le maillage (ce que les suites font moins bien), mais ne fournit ni positions, ni mots-clés, ni backlinks. Il se combine avec la Search Console (gratuite) pour les positions et avec un outil de backlinks pour le netlinking.
Faut-il activer le rendu JavaScript ?
Oui si le site est construit avec un framework JavaScript (React, Vue, Angular, Next.js en rendu client) ou charge des contenus et des liens en JavaScript. Le crawl est plus lent, mais il montre ce que Google indexe réellement. Pour un site WordPress ou statique classique, le crawl HTML suffit.
À quelle fréquence crawler son site ?
Après chaque mise en ligne importante (refonte, migration, nouveau gabarit) et au moins une fois par trimestre pour un site vivant. Les sites qui publient beaucoup ou changent souvent gagnent à ajouter une surveillance continue par un crawler cloud ou un module de santé de site.