Astuces SEO

site: ne liste pas tout

La commande site: n'est pas un inventaire fiable. Voici comment croiser Google Search, Search Console, sitemap, crawl local et logs serveur sans paniquer au mauvais signal.

Lire l'analyse
  • 10 min
  • Mis à jour le 25 septembre 2026
Chat mascotte ToolsBoxSEO comparant la commande site:, le sitemap, Search Console et les logs de crawl.
RubriqueAstuces SEO
Dans cet article

site: ne liste pas tout

Temps de lecture10 min
Lire la suite

Quand la commande site: affiche moins de pages que prévu, la première réaction est souvent mauvaise : on pense que Google a désindexé une partie du site. Parfois c'est vrai. Très souvent, c'est juste un signal mal lu.

Le piège vient du fait que plusieurs outils semblent parler de la même chose alors qu'ils ne mesurent pas le même moment : Google Search affiche des résultats servis pour une requête, le sitemap propose des URL à découvrir, Search Console remonte des états d'indexation, un crawl local voit ce que votre outil peut parcourir, et les logs serveur racontent ce que Googlebot a réellement demandé.

Si vous mélangez tout, vous pouvez perdre une demi-journée à corriger un problème qui n'existe pas, ou pire, ignorer une vraie chute d'indexation parce que le mauvais outil avait l'air rassurant. L'intérêt de ce guide est simple : remettre chaque signal à sa place.

Pourquoi site: n'est pas un inventaire

La commande site: sert à demander à Google des résultats limités à un domaine, un sous-domaine, un répertoire ou un préfixe d'URL. Elle est pratique pour faire une vérification rapide : voir si une page ressort, contrôler quelques titres, regarder si un répertoire apparaît, repérer des URL étranges, ou vérifier qu'une ancienne zone du site ne remonte plus trop visiblement.

Mais ce n'est pas un export d'index. Google le dit clairement dans sa documentation sur l'opérateur site: : les résultats peuvent ne pas être exhaustifs, surtout sur les sites plus larges. Un résultat absent d'une commande site: ne suffit donc pas à conclure qu'une URL n'est pas indexée.

C'est là que beaucoup d'audits partent de travers. Quelqu'un tape site:exemple.com, voit 200 résultats alors que le sitemap contient 900 URL, puis annonce une désindexation massive. Peut-être qu'il y a un vrai souci. Peut-être pas. Sans Search Console, Inspection d'URL et crawl, ce n'est qu'une impression.

site:Utile pour vérifier un échantillon dans les résultats Google, pas pour compter toutes les URL indexées.
Search ConsolePlus fiable pour lire les états d'indexation, mais à interpréter avec ses délais et ses regroupements.
Crawl + logsIndispensables pour comprendre ce que votre site expose et ce que Googlebot visite réellement.

Les signaux à ne pas confondre

Un bon diagnostic commence par une séparation propre des signaux. Ils ne répondent pas tous à la même question.

SignalCe qu'il mesure vraimentCe qu'il ne prouve pasBon usage SEO
site: dans Google SearchDes résultats que Google accepte de servir pour une requête limitée à un domaine ou préfixe.Le nombre exact d'URL indexées, l'exhaustivité de l'index, ou la qualité globale du site.Contrôler des exemples, vérifier un répertoire, chercher une URL précise, repérer des pages inattendues.
Sitemap XMLLes URL que vous proposez aux moteurs, avec éventuellement la date de dernière modification.Que Google a crawlé, indexé ou servira toutes ces URL.Comparer l'inventaire souhaité avec les URL réellement indexables et les rapports Search Console.
Rapport Indexation des pagesLes URL connues de Google, classées entre indexées et non indexées avec des raisons.Le rendu live exact de la page aujourd'hui, ou la position future dans les résultats.Identifier les groupes importants : découvertes, explorées, doublons, redirections, noindex, exclues.
Inspection d'URLL'état Google d'une URL donnée, la version indexée connue et un test d'indexabilité live.Une garantie de classement, ni une prédiction parfaite du canonical choisi à l'avenir.Contrôler une URL stratégique avant de paniquer sur une commande site:.
Crawl localCe que votre crawler peut parcourir depuis les liens, le sitemap ou une liste d'URL.Ce que Googlebot a réellement crawlé, ni ce que Google a choisi d'indexer.Trouver les pages orphelines, statuts HTTP, canonical, robots, profondeur, liens et doublons.
Logs serveurLes requêtes réelles de Googlebot et des autres robots sur votre serveur.Que les URL visitées seront indexées ou bien positionnées.Vérifier les zones crawlées, les erreurs, les redirections, les pics et les URL gaspillées.
Signalsite: dans Google Search
MesureDes résultats servis pour une requête limitée à un domaine ou préfixe.
Ne prouve pasLe nombre exact d'URL indexées.
Bon usageContrôler des exemples, une URL précise ou des pages inattendues.
SignalSitemap XML
MesureLes URL que vous proposez aux moteurs.
Ne prouve pasQue Google les a toutes crawlées ou indexées.
Bon usageComparer l'inventaire voulu avec Search Console et le crawl.
SignalRapport Indexation des pages
MesureLes URL connues de Google, avec états et raisons.
Ne prouve pasLe rendu live exact ou le classement futur.
Bon usageIdentifier les groupes importants à traiter.
SignalInspection d'URL
MesureL'état Google d'une URL donnée et un test live.
Ne prouve pasUne garantie de classement.
Bon usageContrôler une URL stratégique avant de conclure.
SignalCrawl local
MesureCe que votre crawler peut parcourir.
Ne prouve pasCe que Googlebot a réellement crawlé.
Bon usageTrouver statuts, canonical, profondeur, liens et doublons.
SignalLogs serveur
MesureLes requêtes réelles de Googlebot.
Ne prouve pasQue les URL visitées seront indexées.
Bon usageVérifier erreurs, redirections, pics et gaspillage de crawl.

Ce que Google dit officiellement

Google rappelle dans sa documentation sur le fonctionnement de la recherche que le parcours n'est pas automatique : Google découvre des URL, décide quoi explorer, analyse les pages, puis choisit quoi indexer et servir. Toutes les pages découvertes ne sont pas forcément crawlées, et toutes les pages crawlées ne sont pas forcément indexées.

Sur les sitemaps, Google parle aussi d'indication, pas de contrat. La documentation expliquer comment créer un sitemap précise qu'envoyer un sitemap aide Google à découvrir des URL, mais ne garantit pas qu'elles seront toutes utilisées pour le crawl.

Search Console apporte une lecture plus exploitable, notamment via le rapport d'indexation des pages. Les états comme “Découverte, actuellement non indexée”, “Explorée, actuellement non indexée”, “Doublon” ou “Redirection” ne se traitent pas tous de la même façon. Certains demandent une action technique. D'autres sont normaux.

Enfin, l'outil d'inspection d'URL reste le meilleur réflexe quand une page importante semble absente. Il permet de voir l'état connu par Google, de tester l'URL en direct, de demander une indexation et de regarder certains détails comme le canonical sélectionné. Là encore, ce n'est pas une promesse de positionnement, mais c'est beaucoup plus précis qu'un simple site:.

À retenir : un sitemap volumineux, une commande site: faible et un crawl local propre peuvent coexister sans contradiction. Ils ne regardent pas la même couche du problème.

Méthode de vérification en 20 minutes

Quand un écart vous semble suspect, évitez de partir directement en refonte technique. Faites d'abord une vérification courte, dans cet ordre.

Choisir 10 URL représentatives.
Prenez des pages importantes : accueil, catégorie, article récent, article ancien, page outil, page qui rankait, page absente de site:, page présente dans le sitemap et page exclue Search Console.
Tester des commandes ciblées.
Évitez seulement site:exemple.com. Testez une URL complète, un préfixe, un répertoire et quelques titres exacts. La commande globale est souvent trop vague.
Ouvrir Search Console.
Regardez le rapport Indexation des pages, puis filtrez par sitemap si possible. Notez les groupes d'URL, pas seulement le total.
Inspecter les URL stratégiques.
Pour chaque URL importante, utilisez l'inspection d'URL. Vérifiez si elle est indexée, testable en direct, canonique, bloquée ou exclue.
Croiser avec un crawl local.
Contrôlez statut HTTP, canonical, meta robots, profondeur, liens internes, title, duplication et présence dans le sitemap.
Regarder les logs si l'enjeu est réel.
Si des pages importantes disparaissent ou si une migration vient d'avoir lieu, les logs montrent si Googlebot revient, se trompe de zones, rencontre des erreurs ou gaspille son crawl.
Décider une action proportionnée.
Corrigez seulement ce qui est confirmé par plusieurs signaux. Une commande site: bizarre ne suffit pas à modifier toute l'architecture.

Cette méthode complète bien le guide sur les commandes Google disparues ou moins visibles dans les SERP. Les opérateurs de recherche restent utiles, mais ils demandent plus de prudence qu'avant.

Cas pratiques fréquents

Premier cas : le sitemap affiche 800 URL, mais site: donne environ 180 résultats. Ce n'est pas automatiquement grave. Vérifiez d'abord les URL importantes dans Search Console. Si les pages business, articles récents et catégories principales sont bien indexés, le problème peut être un simple effet de lecture. Si beaucoup d'URL stratégiques sont “Explorées, actuellement non indexées”, il faut regarder la qualité, le maillage, la duplication et l'utilité réelle de ces pages.

Deuxième cas : une URL est dans le sitemap, crawlable en local, mais absente de Google. Le sitemap ne suffit pas. Inspectez l'URL, contrôlez le canonical, la meta robots, les redirections, le statut HTTP, la profondeur de liens et le contenu réellement unique. Sur les sites JavaScript ou e-commerce, relisez aussi le guide sur Google, JavaScript et les pages non-200, parce qu'une page jolie dans le navigateur peut envoyer un mauvais signal côté crawl.

Troisième cas : Search Console indique “Découverte, actuellement non indexée”. Google connaît l'URL, mais ne l'a pas forcément explorée. Cela peut venir d'un site trop large, d'un maillage faible, d'une priorité basse ou d'un crawl budget gaspillé. L'article sur la réduction du crawl Google aide justement à faire le tri entre URL utiles et zones qui diluent le signal.

Quatrième cas : les logs montrent Googlebot sur des URL que vous ne voulez plus. Là, site: n'est pas le bon outil. Il faut regarder les redirections, liens internes, liens externes, anciennes URL, paramètres, facettes et sitemaps. Après une migration, l'article sur les logs serveur et Googlebot donne une méthode plus fiable.

Cinquième cas : tout semble propre, mais la page ne ranke pas. Indexation et visibilité ne sont pas la même chose. Une page peut être indexée et ne presque jamais apparaître si elle ne répond pas assez bien à l'intention, si elle manque de preuves, si elle est trop proche d'une autre page, ou si le maillage interne ne la pousse pas. Dans ce cas, la réponse n'est pas un sitemap, mais une reprise éditoriale.

Quand faut-il vraiment agir ?

Il faut agir quand plusieurs signaux racontent la même histoire. Par exemple : une URL stratégique a disparu des performances, elle n'apparaît plus sur des requêtes de marque ou de titre exact, l'inspection d'URL remonte une exclusion, le crawl local montre une erreur technique, et les logs indiquent que Googlebot rencontre des redirections ou statuts incohérents.

Il faut aussi agir quand le rapport Search Console montre une croissance anormale de pages découvertes ou explorées mais non indexées sur des zones importantes. Là, le sujet n'est pas de “forcer Google”, mais de comprendre pourquoi ces pages ne méritent pas assez d'attention : contenu trop faible, duplication, maillage insuffisant, trop de variantes, paramètres, facettes, mauvaise canonicalisation ou pages sorties trop vite.

À l'inverse, une baisse du nombre affiché par site:, isolée, sans chute de trafic, sans alerte Search Console, sans anomalie sitemap et sans problème sur les pages importantes, ne mérite pas une intervention lourde. Notez-la, contrôlez quelques URL, puis passez à un signal plus solide.

Lecture ToolsBoxSEO : le bon audit n'est pas celui qui trouve le plus de différences entre les outils. C'est celui qui explique quelles différences sont normales, lesquelles sont dangereuses, et quoi corriger en premier.

Verdict ToolsBoxSEO

site: reste utile, mais il a perdu son statut de réflexe magique. Il peut rassurer sur une URL, révéler un répertoire oublié, montrer des titres bizarres ou confirmer qu'une ancienne zone ressort encore. En revanche, il ne doit pas servir à compter les pages indexées d'un site.

Pour un diagnostic sérieux, la meilleure combinaison reste : sitemap pour l'inventaire souhaité, crawl local pour l'état technique, Search Console pour l'indexation vue par Google, Inspection d'URL pour les pages clés, et logs serveur quand le crawl réel devient important. Cette lecture croisée évite deux erreurs : paniquer trop vite, ou rester immobile devant un vrai problème.

Si vous venez de publier, refondre ou migrer un site, gardez cette logique en tête. Les écarts entre outils sont normaux. Ce qui compte, c'est la tendance sur les URL importantes, la cohérence technique, la qualité des pages, et la capacité du site à guider Google vers ce qui mérite vraiment d'être vu.

FAQ

La commande site: montre-t-elle toutes les pages indexées ?

Non. Google indique que les résultats de site: ne sont pas toujours exhaustifs. C'est un outil de vérification rapide, pas un export complet de l'index.

Pourquoi mon sitemap contient plus d'URL que Google Search ?

Le sitemap liste les URL que vous proposez aux moteurs. Google peut les découvrir sans forcément les crawler, les indexer ou les servir dans les résultats. Il faut comparer le sitemap avec Search Console, le crawl et les pages réellement utiles.

Quel outil utiliser pour savoir si une page précise est indexée ?

L'outil d'inspection d'URL de Search Console est le meilleur point de départ pour une URL précise. Il donne l'état connu par Google, permet un test live et aide à repérer canonical, robots, erreurs ou exclusions.

Une page absente de site: peut-elle quand même être indexée ?

Oui. Une absence dans une commande site: ne suffit pas à conclure. Il faut contrôler l'URL dans Search Console et parfois tester une requête plus précise autour du titre ou de l'URL.

Que faire avec “Explorée, actuellement non indexée” ?

Regardez d'abord si les URL concernées sont importantes. Si oui, contrôlez la qualité du contenu, le maillage interne, la duplication, le canonical, les signaux de valeur et la cohérence du sitemap. Si ce sont des pages faibles ou inutiles, l'exclusion peut être normale.