En bref

  • Le recensement d’indexation du parc géré par JPL, mené le 11 septembre 2026, a inspecté les 575 URL que nos sept propriétés Search Console soumettent pour indexation, un appel à l’inspection d’URL chacune.
  • Sur les 549 pages réellement offertes à Google, 77,6 % sont indexées. C’est le chiffre tous types de pages confondus.
  • Un chiffre circule dans le contenu SEO voulant que seulement environ 60 % des articles de blogue que vous publiez restent indexés, énoncé sans aucune étude derrière. Nous avons refusé de le répéter et avons mesuré à la place. Sur son propre dénominateur, il s’avère proche : 57,5 % de nos articles de blogue sont indexés.
  • L’affirmation reste fausse dans la façon dont on l’utilise, parce qu’on la répète comme un fait sur la publication en général. Tout ce qui n’est pas un article de blogue s’est indexé à 81,4 %.
  • L’écart, c’est le constat. Les articles de blogue ont été explorés puis refusés à 19,5 %. Tout le reste, à 2,6 %. Sept fois le taux, même parc, même journée.
  • La pire propriété du parc, c’est la nôtre, pas celle d’un client : notre site d’automatisation IA et de flux de travail est indexé à 50 %, et 14 de ses 15 pages refusées sont des articles écrits par des agents IA nommés, sous supervision d’un réviseur humain. Nous le publions parce qu’une agence qui mesure ça devrait accepter d’être mesurée à la même aune.

D’où vient le chiffre de 60 % de pages indexées ?

Nulle part que vous puissiez vérifier. Il circule dans le contenu marketing SEO, énoncé tel quel, sans étude jointe, sans plage de dates, sans échantillon, sans méthode. Nous sommes tombés dessus dans une vidéo de formation où chaque chiffre à l’écran n’était qu’une capture d’écran non vérifiée, produite par le créateur lui-même.

La direction du chiffre correspond à quelque chose de réel. Google a resserré sa sélection à l’indexation, et les praticiens voient effectivement des pages explorées puis écartées. Mais un chiffre rond sans rien derrière n’est pas une statistique, et le répéter à un client n’est pas de l’analyse. Alors nous ne l’avons pas répété. Nous avons mesuré le nôtre.

Nous pouvons le faire parce que nous détenons l’accès Search Console sur l’ensemble des sites que nous construisons et maintenons. C’est le seul vrai avantage ici : pas une meilleure opinion sur l’indexation, un instrument braqué sur un parc de sites.

Comment mesurer l’indexation d’un parc de sites au complet ?

Pour chaque propriété, nous avons pris les URL que le site lui-même soumet par son sitemap. C’est le dénominateur honnête : les pages que le propriétaire a déclaré vouloir dans l’index. Ensuite, nous avons demandé à Google, une URL à la fois par l’API d’inspection d’URL de Search Console, ce qu’il en avait fait. Ça renvoie un état d’indexation par URL, le même verdict que celui qu’on obtient en collant une URL dans Search Console à la main, mais à l’échelle d’un parc entier.

Deux ajustements avant tout pourcentage, tous les deux dans le sens d’être plus dur envers nous-mêmes, pas plus indulgent :

  • Les pages en noindex intentionnel sortent du dénominateur. Vingt-trois pages portent un noindex délibéré. Les compter comme des échecs d’indexation gonflerait le problème avec des pages que personne ne voulait voir indexées.
  • Les URL mortes sortent aussi. Trois entrées du sitemap renvoient une 404. C’est un défaut d’hygiène du sitemap, ça mérite d’être corrigé et listé à part, mais ce n’est pas Google qui refuse une page. C’est nous qui annonçons une page qui n’existe plus.

Ça laisse 549 pages réellement offertes à l’indexation. C’est donc reproductible : le statut noindex et chaque état d’indexation ont été lus dans ce que l’API a retourné, pas dans notre propre lecture des pages. Les types de page ont été attribués selon le chemin d’URL. L’ensemble soumis provient de l’index de sitemaps de chaque propriété et de ses sitemaps enfants, dédupliqués. Google publie le quota, 2 000 requêtes d’inspection par propriété par jour et 600 par minute, alors c’est un exercice que n’importe qui ayant accès à Search Console peut reproduire sur ses propres sites. Chaque chiffre ci-dessous se rapporte aux 549 pages, mesuré en une seule journée. Pas d’échantillonnage, pas d’extrapolation, pas de modélisation.

Quel pourcentage des pages soumises Google indexe-t-il vraiment ?

Recensement d’indexation du parc géré par JPL, 11 septembre 2026. 575 URL soumises inspectées sur sept propriétés, zéro erreur d’API. Le dénominateur exclut 23 pages en noindex intentionnel et 3 URL mortes.
État d’indexationPagesPart des pages offertes
Envoyée et indexée42677,6 %
Non indexée, toutes causes confondues12322,4 %
Explorée, actuellement non indexée295,3 %
Détectée, actuellement non indexée7613,8 %
Google ne reconnaît pas cette URL173,1 %
Page en double : Google n’a pas choisi la même URL canonique que l’utilisateur10,2 %

77,6 % d’indexation, tous types de pages confondus. C’est le chiffre du parc, et pris seul, c’est le mauvais chiffre à comparer à l’affirmation de départ.

Le chiffre de 60 % était-il vrai ?

Jugée sur son propre terrain, oui, à peu près. L’affirmation porte spécifiquement sur les articles de blogue, alors nous avons typé les 549 pages offertes par chemin d’URL et refait le même découpage.

Les mêmes 549 pages offertes, réparties par type de page. C’est la comparaison à conditions égales que l’affirmation qui circule appelle vraiment.
Type de pageOffertIndexéeIndexée %Explorée et refusée
Articles de blogue875057,5 %17 (19,5 %)
Tout le reste46237681,4 %12 (2,6 %)

Nos articles de blogue sont indexés à 57,5 %. Le chiffre sans source disait environ 60 %. Nous avons refusé de répéter ce chiffre parce que personne ne l’avait mesuré, et notre propre mesure s’en est approchée à trois points près. Ça vaut la peine de le dire clairement plutôt que de l’enterrer, et c’est la partie de cet exercice qu’on n’attendait pas.

Ce qui cloche dans l’affirmation, ce n’est pas l’arithmétique, c’est la portée qu’on lui donne. Elle circule comme un fait sur la publication en général, et on la répète aux propriétaires comme si chaque page qu’ils mettent en ligne avait quatre chances sur dix de disparaître. Sur notre parc, c’est faux. Tout ce qui n’est pas un article de blogue s’est indexé à 81,4 %. L’échec se concentre dans un seul type de page, et la phrase utile porte sur l’écart, pas sur la moyenne.

Les articles de blogue ont été explorés puis refusés à 19,5 %. Tout le reste, à 2,6 %. Même parc, même robot d’exploration, même journée, sept fois le taux. C’est le constat, et c’est celui que le chiffre emprunté occulte en transformant un problème de type de page en angoisse généralisée.

Pourquoi ma page n’est-elle pas indexée ? Trois états, trois corrections différentes

Sur les 549 pages que nos sept propriétés offrent à Google, 123 ne sont pas indexées. Search Console rapporte ces cas comme des états d’indexation distincts, et c’est en les traitant comme un seul chiffre qu’on finit par corriger la mauvaise chose.

Explorée, actuellement non indexée. Google a récupéré la page, l’a lue, et a choisi de ne pas l’indexer. C’est ce qui se rapproche le plus d’un verdict de qualité que Google vous donne gratuitement. C’est 29 pages, 5,3 % des 549, et comme le montre le découpage plus haut, c’est massivement un état propre aux articles de blogue.

Détectée, actuellement non indexée. Google sait que l’URL existe et ne l’a pas récupérée. Aucun verdict n’a été rendu. C’est la plus grosse part, 76 pages, 13,8 % des 549. D’après notre pratique plutôt que d’après ce recensement, le levier sur cet état, c’est le maillage interne, la discipline du sitemap, et donner au robot une raison de revenir, pas de la prose. Nous n’avons pas mesuré ça ici non plus, et nous le dirons quand ce sera fait.

Google ne reconnaît pas cette URL. Dix-sept pages, 3,1 % des 549. L’URL se trouve dans un sitemap et Google n’en a aucune trace. Sur une propriété récente, c’est surtout une question de temps. Sur une propriété établie, c’est un défaut de découverte qui mérite d’être creusé. Ces états bougent aussi d’eux-mêmes : pendant que nous écrivions ce texte, trois URL que le recensement avait enregistrées comme inconnues étaient déjà passées à l’état détectée dès l’après-midi même.

Fusionnez ces trois états en un seul pourcentage, et vous obtenez un constat d’audit qui dit à un client de réécrire 123 pages. Gardez-les séparés, et la vraie consigne devient : réécrire 29 pages, corriger le maillage interne pour 76, et chercher pourquoi 17 restent invisibles.

Quel genre de pages Google a-t-il explorées puis refusées ?

Les 29 pages explorées puis refusées ne se répartissent pas au hasard, et le schéma est inconfortable si votre plan de contenu repose sur le volume.

  • Dix-sept sont des articles de blogue. Des articles publiés pour bâtir une couverture thématique, lus par Google, et laissés hors de l’index.
  • Neuf sont des pages de service quasi identiques, surtout le même service réécrit ville par ville sur un site client. Les variantes par ville ont été refusées alors que les pages de service parentes ont été indexées. Google ne dit pas pourquoi, mais la lecture la plus économique, c’est qu’il a déjà cette page.
  • Une est une archive d’auteur qui n’aurait jamais dû se retrouver dans un sitemap. Un réglage par défaut du système de gestion de contenu, soumis à l’indexation, refusé. Ce n’est pas un problème de contenu, c’est une fuite de configuration.
  • Deux sont d’autres pages : une page d’atterrissage verticale et une page de transparence.

Sur les 29 pages que Google a explorées puis refusées, aucune n’était une page de service principale. Relu comme une consigne, ce constat n’est pas tendre envers les conseils habituels : les pages qui rapportent se sont bien indexées, et c’est dans les pages publiées pour les soutenir que la sélection à l’indexation a frappé.

Une note de praticien qui mérite l’espace. Ces neuf pages quasi identiques par ville ont atterri dans explorée-puis-refusée, pas dans l’état de canonique en double. Sur l’ensemble du recensement, une seule page a renvoyé « Page en double : Google n’a pas choisi la même URL canonique que l’utilisateur ». Si vous auditez vos propres pages par ville, n’allez pas les chercher sous l’état de doublon. Elles se trouveront dans le même panier que vos articles de blogue trop minces.

À quoi ça ressemble sur nos propres sites, y compris le pire ?

Une moyenne de parc cache l’étalement, et c’est l’étalement qui est intéressant. Voici chaque propriété. Les sites clients ne sont pas nommés. Les nôtres le sont, parce que c’est à nous de les exposer.

Indexation par propriété, même recensement. Offert = URL soumises moins le noindex intentionnel et les URL mortes.
PropriétéOffertIndexéeIndexée %Explorée et refusée
couvreursverifies.ca (notre annuaire)15513486,5 %0
Site client A (fabricant)201890,0 %0
Site client B (services)14411680,6 %0
Site client C (services)755269,3 %10
jpldigital.ca726184,7 %2
Notre site de sous-marque FR231565,2 %2
Notre site d’automatisation IA et de flux de travail603050,0 %15

Quatre de ces sept propriétés sont les nôtres, y compris la meilleure ligne et la pire. Les trois autres sont des sites clients et restent anonymes. La meilleure, c’est notre annuaire de couvreurs à 86,5 %, sans aucune page refusée, et l’essentiel de l’explication, c’est qu’il a environ sept semaines et un ensemble d’URL propre, construit sur mesure.

La pire est aussi la nôtre, à 50 %. Deux choses l’expliquent, et une seule est confortable. C’est un jeune site qui publie dans une catégorie où Google dispose déjà d’une couverture abondante, la condition même sous laquelle la sélection à l’indexation devient stricte. C’est aussi la propriété dont le blogue est écrit par des agents de recherche IA nommés, sous supervision d’un réviseur humain, ce qui est divulgué sur le site lui-même, et 14 de ses 15 pages refusées sont ces articles. Nous n’allons pas rapporter la première raison en passant la seconde sous silence.

Prenez ce constat à sa juste taille. C’est une seule propriété, un seul jour, 15 pages, et c’est confondu avec l’âge du site et la saturation de la catégorie. Ce n’est pas un résultat sur le contenu écrit par l’IA en général, et nous n’allons pas le présenter comme tel. C’est une vraie chose qui est arrivée sur notre propre site, et c’est pour ça que le prochain recensement compte plus que celui-ci.

Publier le chiffre, c’est tout l’intérêt de l’exercice. Si nous faisions cet audit pour vous et que nous vous montrions un 69 %, vous auriez parfaitement le droit de demander à quoi ressemble le nôtre.

Ce qu’un audit d’indexation devrait vérifier

La plupart des audits qu’on vous vendra donnent un score. Un score, ce n’est pas exploitable. Ce que vous voulez tirer de cette partie d’un audit, ce sont cinq choses, et vous pouvez les demander par leur nom.

  • L’état d’indexation de chaque URL soumise, pas un échantillon. URL par URL, tiré de Search Console, pas déduit par un robot d’exploration tiers. Un robot tiers vous dit ce que votre site raconte, seul Google vous dit ce que Google a fait.
  • Un dénominateur avec lequel vous êtes d’accord. Le noindex intentionnel retiré, les URL mortes retirées et listées à part comme un défaut d’hygiène. Si personne ne vous montre le dénominateur, le pourcentage ne veut rien dire.
  • Les chiffres répartis par type de page. Un taux global pour tout le site aurait caché l’ensemble du constat ci-dessus. Les articles de blogue, les pages de service et les archives échouent différemment, et une moyenne toutes pages confondues ne vous dit pas où est le problème.
  • Les trois états de non-indexation gardés séparés, parce qu’ils débouchent sur trois chantiers différents.
  • La liste des pages refusées elle-même, page par page. Le schéma dans cette liste, c’est ça, le vrai constat. La nôtre pointait vers le volume de blogue et les doublons par ville. La vôtre dira autre chose.

Si vous voulez vérifier une seule chose vous-même cet après-midi, ouvrez Search Console, collez vos trois pages les plus récemment publiées dans la boîte d’inspection d’URL, et lisez l’état d’indexation. Ça prend deux minutes, et c’est le même instrument qu’on vient de braquer sur 575 URL. Quand nous le faisons sur une propriété entière, ça fait partie d’un audit SEO express, et la liste des refus, c’est le livrable, pas le score.

L’indexation affecte-t-elle la visibilité IA ?

Elle est en amont de la visibilité IA. Un moteur de réponse qui ancre sa réponse dans la recherche ne peut pas citer une page absente de l’index, alors une page coincée en exploré-puis-refusé est invisible sur les deux surfaces à la fois. Nous avons déjà écrit sur la façon dont les systèmes d’IA choisissent quoi citer et sur la préférence partagée qui concentre ces citations sur un petit ensemble de sources. La couche au-dessus de celle-ci, c’est ce qu’un modèle se rappelle quand il ne va jamais rien vérifier, une couche qu’aucun travail d’indexation n’atteint. Celle-ci, c’est le plancher sous le cas où il vérifie. Être dans l’index ne vous garantit pas une citation. En être exclu en ferme la porte.

Ce que cette mesure n’est pas

La portée, sans détour, parce que tout l’exercice reposait justement sur le refus de répéter un chiffre sans source :

  • C’est notre parc, pas le web. Sept propriétés, 549 pages, des sites de PME québécoises et des sites appartenant à JPL. C’est une vraie mesure d’une vraie population, et cette population est petite et nous appartient. Ne lisez ni 77,6 % ni 57,5 % comme un repère sectoriel.
  • Être indexé, c’est un plancher, pas un résultat. Une page peut être indexée et ne récolter aucune impression du tout. Ce recensement ne dit rien sur le trafic, le classement ou le chiffre d’affaires, et viser 100 % d’indexation n’est pas un objectif qui vaut la peine d’être poursuivi pour lui-même.
  • C’est une seule journée. Les états d’indexation bougent, comme le montrent les trois qui ont bougé pendant que nous écrivions ce texte. Une page détectée-non-indexée aujourd’hui peut être indexée le mois prochain sans que personne n’y touche. Nous n’avons pas encore fait cet exercice deux fois, alors nous ne pouvons pas vous donner le rythme du changement.
  • Trois sites manquent à l’appel, et leur absence flatte probablement le chiffre. Trois sites clients se trouvent derrière une protection anti-robots au niveau de l’hébergeur, qui répond aux requêtes automatisées par une vérification plutôt que par leur sitemap, alors nous n’avons pas pu assembler leur liste d’URL soumises sans contourner un contrôle de sécurité, ce que nous ne ferons pas. Ces sites comptent parmi les plus anciennes bibliothèques de contenu du parc. Notre attente, tirée de la pratique et non de ce recensement, c’est que les bibliothèques plus anciennes portent davantage de pages refusées, ce qui placerait le vrai chiffre sous 77,6 % plutôt qu’au-dessus. Nous le saurons quand nous pourrons les mesurer.
  • L’état d’indexation est un verdict, pas une explication. Google vous dit qu’il a refusé une page. Il ne vous dit pas pourquoi. Les schémas décrits plus haut sont notre lecture de la liste des refus, pas les raisons énoncées par Google.

Nous allons refaire ce recensement et publier le mouvement. Ce deuxième chiffre, c’est celui qui vous dira vraiment si réécrire les pages refusées fonctionne, et nous préférons l’attendre plutôt que de l’affirmer maintenant.