Avant qu'une page ne se positionne, Google doit franchir trois étapes avec elle : la découvrir, l'explorer, puis décider de l'indexer. Le SEO technique, c'est l'art de fluidifier ce parcours, de repérer où il se grippe et de le corriger.
Cette rubrique regroupe les guides transversaux d'IndexProbe sur le crawl et l'indexation. Là où la rubrique Statuts d'indexation Google Search Console décortique chaque état du rapport une ligne à la fois, ces guides prennent le sujet par la mécanique : comment Google découvre vos URLs, à quel rythme il les explore, et pourquoi certaines n'atteignent jamais l'index.
Diagnostic d'un site invisible
Pourquoi mon site n'apparaît pas sur Google : le diagnostic complet
Un site absent de Google relève de trois cas, jamais indexé, désindexé, ou indexé mais mal positionné, et chacun demande un traitement différent. L'arbre de décision complet, du symptôme au statut de la Search Console, jusqu'à la vérification du retour.
Vérifier son indexation
Outil d'inspection d'URL de Google : le guide complet (et ses limites)
Le seul endroit où Google dit, URL par URL, ce qu'il a fait de vos pages : verdict, statut de couverture, canonique retenue, dernier crawl, page rendue. Chaque bloc de données décodé, les deux modes (version indexée vs test en direct), les limites structurelles de l'outil, et l'API officielle pour passer à l'échelle.
L'API Google Search Console pour le SEO
Les deux API que les SEO utilisent vraiment (Search Analytics et URL Inspection), la mécanique réelle des quotas que Google ne détaille pas (fenêtre glissante, quota par propriété, propriétés à préfixe), et le moment où récupérer ses données d'indexation à la main cesse de tenir : sur les gros sites et en agence surtout.
Découverte et soumission
Soumettre son site à Google
De la demande d'indexation à la vérification. Pourquoi soumettre ne garantit rien, comment déclarer proprement un sitemap, les vraies limites de l'outil d'Inspection d'URL, et comment confirmer ce que Google a réellement indexé.
Budget de crawl et fréquence d'exploration
Budget de crawl : est-ce vraiment votre problème ?
Un vrai levier SEO, mais pas pour tous les sites. Pour qui le budget de crawl compte réellement, pourquoi le seuil se situe bien plus bas que le million de pages annoncé par Google, et comment repérer, URL par URL, où le budget se dilue.
Erreurs de crawl et codes HTTP
Corriger les erreurs 404 dans la Google Search Console
Toutes les 404 ne se valent pas, et toutes ne se corrigent pas de la même façon. Distinguer les 404 légitimes des liens cassés à réparer, et traiter le volume sans y passer ses journées. (Ce guide est aussi rattaché à la rubrique Statuts d'indexation GSC.)
Facettes et volumes d'URL
Navigation à facettes : quels filtres indexer en SEO
Une seule page catégorie et quatre filtres suffisent à générer des milliers d'URL explorables. Quelles facettes méritent l'index, lesquelles fermer (et comment), et comment lire le verdict de Google famille par famille au lieu de le deviner.
Contenu dupliqué et canoniques
Contenu dupliqué et SEO : le vrai problème n'est pas la pénalité
Le contenu dupliqué n'entraîne pas de pénalité : Google regroupe vos pages en double et n'en retient qu'une, la canonique. Le vrai problème surgit quand il retient une autre page que la vôtre. Ce que dit la documentation 2026, les statuts de la famille doublons décodés, et comment vérifier à l'échelle quelle canonique Google a retenue.
Rendu JavaScript et frameworks
JavaScript et SEO : ce que Google indexe vraiment après le rendu
Le rendu JavaScript de Google fonctionne aujourd'hui comme une file asynchrone, loin du vieux modèle des « deux vagues ». Comment Googlebot exécute votre JS, pourquoi le rendu de votre crawler n'est pas le verdict de Google, et la grille symptôme de rendu → statut GSC, pour les SPA comme pour les sites classiques.
SEO des SPA React : 4 statuts d'indexation à surveiller
Une single-page application (React, Vue, Angular) n'expose son contenu qu'après l'exécution du JavaScript, et un rendu qui échoue ne renvoie aucune erreur. Les quatre statuts de la Search Console qui trahissent une SPA mal indexée, et le triage honnête avant de tout basculer en SSR.
Pagination et profondeur de crawl
Pagination SEO : quel statut Google pour vos pages paginées
Chaque page paginée reçoit son propre verdict dans la Search Console, et tous ne se valent pas : « Explorée, non indexée » sur une page 3 est souvent normal, un statut canonique est presque toujours une erreur de configuration. La grille de lecture, les erreurs classiques (dont la canonique vers la page 1) et le diagnostic à l'échelle.
À venir dans cette rubrique
Le SEO technique du crawl et de l'indexation ne s'arrête pas là. Plusieurs guides sont en préparation : le contenu dupliqué sur les sites e-commerce, et un guide de décision pour trancher entre canonical, noindex, robots.txt ou 404 selon la situation.
Les pièges d'indexation propres à chaque CMS font l'objet d'une rubrique dédiée : Pièges d'indexation par CMS.
Pourquoi ces guides comptent
Un problème de crawl ou d'indexation ne se voit pas à l'œil nu : une page peut sembler parfaite et rester hors de l'index pendant des semaines. La seule source fiable est le verdict officiel de Google, page par page. Le vérifier à la main dans la Search Console, une URL à la fois, ne tient pas à l'échelle. C'est précisément ce que fait IndexProbe : la version en masse de l'outil d'Inspection d'URL, qui interroge l'API officielle de la Search Console pour toute la liste d'URLs que vous fournissez ou constituez depuis la GSC, avec le statut d'indexation, le motif de non-indexation et la date du dernier crawl pour chacune.
La couche technique n'est jamais une fin en soi : elle sert des situations concrètes — migration, surveillance, gros catalogues, baisses de trafic. Les cas d'usage d'IndexProbe relient chacun de ces chantiers aux données officielles de la Search Console.
Questions fréquentes
Quelle différence entre crawl et indexation ?
Le crawl (ou exploration) est la visite de Googlebot qui lit la page. L'indexation est la décision de Google de la conserver dans son index. Une page peut être crawlée sans être indexée : Google l'a lue, mais n'a pas jugé utile de la retenir. Les deux étapes sont distinctes, et un problème peut survenir sur l'une comme sur l'autre.
Par où commencer un audit SEO technique ?
Par le rapport « Indexation des pages » de la Google Search Console, qui montre combien de vos URLs sont indexées et pourquoi les autres ne le sont pas. C'est le point de départ : il oriente vers le bon guide, qu'il s'agisse d'un problème de découverte, de budget de crawl, d'erreurs HTTP ou de doublons.
Ces guides s'adressent-ils aux petits sites ?
En partie. Certains sujets, comme la soumission ou les erreurs 404, concernent tous les sites. D'autres, comme le budget de crawl ou la navigation à facettes, ne deviennent des enjeux réels qu'à partir d'un certain volume d'URLs. Chaque guide précise clairement pour qui le sujet est pertinent, sans dramatiser inutilement.