URL découvertes
Ce sont les adresses que le crawler a trouvées dans votre sitemap ou dans les liens de votre site. Elles n’ont pas forcément encore été analysées.
Indiquez simplement l’adresse de votre site ou de son sitemap XML. Le crawler recherche d’abord les sitemaps connus. S’il n’en trouve aucun d’exploitable, il suit les liens internes pour trouver les pages à analyser.
Lorsque vous indiquez l’adresse de votre site, l’outil recherche automatiquement son sitemap XML afin d’identifier les pages à analyser. Vous pouvez également choisir d’explorer votre site en suivant ses liens internes. La limite choisie est un plafond de traitement : toutes les URL trouvées ne seront pas forcément analysées. En suivant les liens internes, la profondeur 0 correspond à la page de départ, 1 à ses liens directs et 3 à des pages plus éloignées.
Agent IA construit puis copie uniquement un brief local. Aucun rapport n’est envoyé automatiquement à un fournisseur d’IA.
Lancez un crawl, puis sélectionnez une catégorie pour comprendre son score et consulter les critères analysés.
La note globale combine neuf catégories, selon leur pondération et les critères applicables aux pages analysées. Elle est publiée à partir de 50 % de couverture des critères pondérés. Une récupération HTML incomplète laisse les notes SEO et GEO IA non mesurées pour la page concernée. Le diagnostic Code est présenté séparément : il contrôle le HTML des pages récupérées et chaque source CSS unique, externe ou intégrée, sans validateur W3C externe. Sa pondération interne est de 70 % pour le HTML et 30 % pour le CSS ; il ne modifie pas la note globale.
Vue globale : tous les critères du crawl sont affichés.
Votre objectif
Un crawl consiste à parcourir les pages HTML publiques et les liens de votre site afin d’identifier les problèmes qui peuvent affecter son référencement ou son bon fonctionnement.
Il vous donne une vue d’ensemble des pages réellement analysées, dans le périmètre et la limite choisis. Vérifiez d’abord quelles pages figurent dans le rapport. Vous pourrez ensuite repérer les problèmes qui reviennent sur plusieurs pages et les corrections qui peuvent améliorer plusieurs contenus à la fois.
Étape 1
Pour pouvoir comparer deux analyses dans le temps, utilisez la même adresse de départ et conservez les mêmes réglages : limite de pages, profondeur, délai et méthode d’exploration.
Saisissez simplement votre nom de domaine pour laisser l’outil rechercher automatiquement les pages à analyser. Si vous connaissez l’adresse de votre sitemap XML, vous pouvez également l’indiquer directement.
Pour un premier crawl, définissez une limite adaptée à la taille de votre site. Il s’agit d’un plafond de traitement : les URL trouvées ne seront pas toutes forcément récupérées et analysées.
La profondeur indique jusqu’où le crawler doit suivre les liens de votre site. Plus elle est élevée, plus l’outil pourra atteindre des pages éloignées de la page de départ. Profondeur 0 : page de départ uniquement. Profondeur 1 : liens directs. Profondeur 3 : pages plus éloignées dans le parcours interne.
Ce délai aide à limiter les demandes envoyées au serveur de votre site. Pour un premier crawl, conservez le réglage proposé. Augmentez-le si le site répond lentement ou limite les accès automatisés.
Par défaut, l’outil utilise les sitemaps XML exploitables qu’il trouve pour identifier les pages à analyser. Activez « Ne pas tenir compte du sitemap XML » pour découvrir les pages uniquement en suivant les liens internes du site.
Pour mesurer les progrès après vos corrections, relancez la même adresse avec les mêmes paramètres : limite, profondeur, délai et option de sitemap XML. Vous pourrez ainsi comparer les résultats plus facilement.
Étape 2
Avant d’interpréter les scores, regardez combien de pages ont réellement été parcourues. Le rapport se base uniquement sur les pages HTML que le crawler a pu analyser. Vérifiez si les parties importantes de votre site sont présentes ou si la couverture reste trop limitée pour conclure.
Ce sont les adresses que le crawler a trouvées dans votre sitemap ou dans les liens de votre site. Elles n’ont pas forcément encore été analysées.
Ce sont les pages HTML que le crawler a pu consulter et intégrer dans votre rapport. Elles sont prises en compte dans les résultats et les scores, selon les critères qui leur sont applicables.
Ce sont les pages que l’outil n’a pas réussi à analyser, par exemple à cause d’une erreur, d’un temps de réponse trop long ou d’un blocage technique.
Ces adresses ont bien été trouvées, mais le crawler ne les a pas analysées. Cela peut notamment être dû à la limite de pages choisie, à la profondeur du crawl ou à certaines règles techniques du site. Les doublons déjà visités et les fichiers non HTML peuvent aussi être écartés du parcours.
Étape 3
Les scores vous donnent une vue d’ensemble des pages réellement analysées, à partir des critères qui leur sont applicables. Sélectionnez chaque catégorie pour consulter les problèmes signalés, les éléments observés et les pages concernées.
Plusieurs points importants ont été signalés et méritent une vérification rapide des pages concernées.
Les pages analysées présentent de bonnes bases, mais certains problèmes ou écarts restent à vérifier et à corriger.
Les résultats sont globalement satisfaisants. Pensez tout de même à vérifier les pages importantes et les problèmes signalés individuellement.
La note concerne uniquement les pages HTML analysées. Elle ne décrit pas automatiquement toutes les adresses trouvées ni l’ensemble du site.
Si un critère ne concerne pas une page, il est écarté de son calcul. Il n’est pas compté comme un zéro.
Pour comparer deux rapports, gardez la même adresse de départ et les mêmes réglages de limite, profondeur, délai et découverte des pages.
Vérifie les éléments qui aident les moteurs à comprendre vos pages : titres, descriptions, H1, contenu, consignes d’indexation et balises canoniques.
Analyse les indices de clarté et d’organisation des contenus qui peuvent aider les assistants IA à les comprendre et éventuellement les reprendre. Ce score ne mesure pas leur présence réelle dans les réponses des IA.
Vérifie les données structurées Schema.org qui aident les moteurs à comprendre vos pages : leur présence, leur validité et leur cohérence avec le contenu visible.
Repère des risques de lecture ou d’utilisation sur smartphone à partir des éléments analysables : adaptation à l’écran, lisibilité et interactions tactiles.
Repère certains éléments qui peuvent compliquer l’utilisation de votre site pour les personnes ayant des besoins spécifiques. Cela concerne notamment la structure, les alternatives aux images, les libellés et la navigation accessibles.
Vérifie certains éléments de sécurité observables dans les pages et les réponses HTTP : HTTPS, contenus mixtes, formulaires et protections déclarées.
Recherche les problèmes techniques pouvant affecter le fonctionnement ou l’exploration de vos pages : erreurs HTTP, redirections, temps de réponse ou fichiers trop lourds.
Analyse la façon dont vos pages sont reliées entre elles et repère notamment les liens cassés ou les pages importantes difficiles à atteindre.
Vérifie les titres, descriptions et images prévus pour le partage de vos pages sur les réseaux sociaux.
L’audit recherche certaines erreurs dans le code des pages analysées afin d’identifier les problèmes susceptibles d’affecter leur affichage, leur accessibilité ou leur fonctionnement. Ce contrôle utilise des règles locales, sans validateur externe, et n’entre pas dans le score global du site.
Étape 4
L’un des principaux avantages du crawl est de repérer les problèmes qui se répètent sur plusieurs pages. Vous pouvez ainsi rechercher leur origine et, lorsque c’est possible, effectuer une seule correction plutôt que de modifier chaque page séparément.
Vérifiez que les pages les plus importantes de votre site ont bien été analysées et regardez si certaines pages n’ont pas pu être prises en compte.
Regardez combien de pages sont concernées et si elles sont importantes pour votre activité : services, produits, catégories ou articles.
Une erreur présente sur une seule page peut généralement être corrigée directement. Si elle apparaît sur de nombreuses pages, son origine se trouve probablement dans un élément commun du site.
Traitez en priorité les erreurs qui peuvent empêcher une page de fonctionner correctement, d’être accessible ou d’apparaître dans les résultats de recherche.
Lorsqu’une même erreur touche plusieurs pages, recherchez l’élément commun qui en est responsable. Une seule correction peut parfois résoudre le problème sur une grande partie du site.
Vérifiez d’abord quelques pages représentatives, puis relancez le crawl depuis la même adresse avec les mêmes réglages. Comparez la couverture, les pages concernées et la fréquence des problèmes pour voir s’ils ont disparu ou diminué.
Consultez les éléments signalés sur quelques pages représentatives avant d’appliquer une correction à toutes les pages qui utilisent le même modèle.
Gardez votre rapport avant les corrections, puis comparez-le à un nouveau crawl réalisé avec la même adresse et les mêmes réglages. Les exports permettent de partager les résultats et les actions prévues.
Prépare des instructions techniques dans votre navigateur et les copie dans le presse-papiers. Vous choisissez ensuite de les transmettre à un assistant de développement. Aucun rapport n’est envoyé automatiquement à un fournisseur d’IA et aucune correction n’est lancée.
Étape 5
Pas besoin de maîtriser tout le vocabulaire technique pour utiliser Crawl Site. Retrouvez ici la définition des principaux termes que vous pouvez rencontrer dans votre rapport.
La densité de mots-clés (keyword density) représente le pourcentage d’apparition d’un mot ou d’une expression dans le contenu principal visible d’une page. Le crawl la calcule page par page pour faire ressortir les expressions dominantes et les répétitions qui méritent une relecture.
Formule : Densité = (nombre d’occurrences du mot-clé / nombre total de mots) × 100. Par exemple, 15 occurrences dans un texte de 500 mots donnent une densité de 3 %.
Repère éditorial courant pour une expression dominante. Ce n’est ni un objectif obligatoire ni une garantie de classement.
Zone à surveiller : relisez la page et vérifiez que les répétitions restent naturelles et utiles.
Répétition élevée à vérifier dans son contexte. Préférez la clarté, les variantes utiles et les synonymes naturels.
À retenir : Google ne publie pas de densité idéale universelle et une valeur supérieure à 3 % ne prouve pas, à elle seule, un keyword stuffing ni une pénalité. Ce repère n’enlève donc aucun point au score. Une marque, un terme technique ou le type de page peuvent expliquer une fréquence élevée.
La densité de mots-clés mesure la fréquence d’un terme précis. Elle ne doit pas être confondue avec la densité lexicale, qui décrit la variété des mots porteurs de sens.
Commencez par vérifier les pages réellement analysées, puis regardez les problèmes qui reviennent le plus souvent et les pages qui n’ont pas pu être explorées. Le score global donne une première indication. Un problème bloquant sur une page importante, ou répété sur plusieurs pages, peut rester prioritaire même si la note générale est bonne.
Retrouvez ici les principaux résultats de votre crawl : pages analysées, scores obtenus et améliorations à traiter en priorité.
Repérez les liens internes ou externes signalés comme cassés et identifiez les pages et les textes de liens concernés pour vérifier et corriger leurs destinations.
Identifiez les thèmes déjà abordés et certaines pistes à approfondir à partir des pages analysées. Cette analyse ne repose pas sur une recherche externe de mots-clés et ne modifie aucun score. Un thème absent n’est pas automatiquement une erreur.
Retrouvez les principales améliorations recommandées à partir des problèmes détectés sur les pages analysées.
Consultez les résultats de chaque page pour identifier rapidement celles qui nécessitent le plus votre attention.
Les scores sont calculés uniquement à partir des pages que le crawler a réellement pu analyser et des critères qui s’appliquent à chacune d’elles. Une donnée indisponible ou non pertinente n’est donc pas automatiquement considérée comme un mauvais résultat. L’analyse du code est présentée séparément. Elle recherche des problèmes dans le HTML des pages et les fichiers CSS utilisés, mais n’entre pas dans le calcul du score global du site.
| Indicateur | Ce qui est analysé | À quoi ça sert |
|---|---|---|
| Score global | SEO, GEO IA, Schémas, Mobile, Accessibilité, Sécurité, Technique, Architecture et Social. | Ces neuf catégories contribuent au score global selon leur pondération, uniquement sur les critères applicables. Elles donnent une vue d’ensemble des pages analysées. |
| Qualité du code | HTML de toutes les pages récupérées et chaque source CSS unique, avec une pondération interne de 70 % / 30 %. | Repère certaines erreurs techniques avec les règles locales de l’outil, sans validateur W3C externe ni double analyse d’une même source. Ce résultat reste hors du score global. |
| Évolution dans le temps | Même adresse de départ, même limite, même profondeur, même délai et même méthode de découverte des pages. | Comparer les résultats et vérifier l’effet des corrections sur les pages analysées. |
Le crawl s'appuie sur des référentiels publics pour construire ses règles locales de structure HTML, d’accessibilité, de données structurées, de performance et de sécurité.
FAQ du Crawl Site
Crawl Site parcourt les pages HTML publiques d’un même site, dans le périmètre et la limite choisis. Il repère des problèmes pouvant affecter le référencement ou le fonctionnement des pages analysées : erreurs techniques, contenu, liens internes, éléments de sécurité observables, accessibilité et indices de compréhension par les IA.
Son principal intérêt est de repérer les problèmes qui se répètent sur plusieurs pages afin de savoir quelles corrections effectuer en priorité.
Dans la plupart des cas, saisissez simplement l’adresse de votre site. Crawl Site recherche automatiquement ses sitemaps connus et suit les liens internes s’il n’en trouve aucun d’exploitable.
Vous pouvez aussi saisir l’adresse complète d’un sitemap XML du site. Le rapport indique les URL effectivement découvertes et analysées : vérifiez ce périmètre. Dans les deux cas, la limite choisie reste un plafond de traitement.
Activez cette option si vous souhaitez que le crawler découvre votre site uniquement en suivant ses liens internes, sans utiliser le sitemap.
Cela peut notamment être utile pour repérer les pages difficiles à atteindre depuis les autres contenus du site. Dans la plupart des cas, vous pouvez conserver le réglage par défaut.
Une URL découverte est une adresse trouvée dans un sitemap XML ou un lien. Elle devient une page analysée lorsque le crawler a pu récupérer une page HTML exploitable et l’intégrer au rapport.
Une URL échouée correspond à une récupération qui n’a pas abouti. Une URL non poursuivie a été trouvée, mais une limite de pages, la profondeur, le périmètre, les règles du site, un doublon ou le type de ressource l’écartent du parcours.
Non. Seules les pages HTML récupérées et analysées sont comptabilisées. Les images, PDF et autres fichiers peuvent être repérés comme ressources ou liens, même dans un sitemap XML, mais ils ne sont pas ajoutés au nombre de pages analysées.
Pour un premier crawl, vous pouvez commencer avec un nombre raisonnable de pages, une profondeur de trois niveaux et le délai proposé par l’outil.
Si certaines pages importantes ne sont pas analysées, augmentez progressivement la limite ou la profondeur selon la cause. Augmentez le délai si le serveur répond lentement ou limite les accès automatisés. Pour comparer les résultats après vos corrections, conservez la même adresse de départ et les mêmes réglages.
Non. Le score moyen donne une tendance générale à partir des pages analysées, mais certaines pages peuvent obtenir de bien meilleurs ou de moins bons résultats.
Ne vous arrêtez donc pas à la note globale : vérifiez la couverture, les problèmes détectés, leur fréquence et les pages concernées, surtout celles qui sont importantes pour votre activité. Une bonne moyenne peut masquer une erreur bloquante sur une seule page.
Il est recommandé de relancer un crawl après une modification importante de votre site : refonte, migration, changement de navigation ou modifications touchant plusieurs pages.
Relancez-le aussi après un changement de sitemap XML ou de règles d’indexation. Vous pouvez effectuer des crawls régulièrement, selon l’activité du site, pour repérer de nouveaux problèmes. Utilisez la même adresse de départ et les mêmes réglages pour comparer les résultats.
Agent IA prépare des instructions techniques à partir des problèmes détectés pendant le crawl, puis les copie dans le presse-papiers. Vous pouvez ensuite les transmettre à un assistant de développement pour vous aider à appliquer les corrections.
Aucun rapport n’est envoyé automatiquement à un fournisseur d’IA et aucune modification n’est effectuée automatiquement sur votre site.
Non. Crawl Site consulte uniquement les pages publiques de votre site pour les analyser. Il ne modifie ni vos pages, ni vos contenus, ni vos réglages.
Vos nouveaux rapports restent également privés par défaut. Vous choisissez vous-même si vous souhaitez les publier.