Le WordPress d'aujourd'hui, décodé pour les développeurs

SEO & GEO

« Alternate page with proper canonical tag » appliqué à tort sur des pages uniques

Google traite des pages de contenu pourtant original comme de simples doublons. Le coupable : un gabarit trop proche visuellement d'une autre page du même site.

Par Clément Hadrot • 10 août 2025 • 5 min de lecture • Aucun commentaire
"Alternate page with proper canonical tag" appliqué à tort sur des pages uniques

« Alternate page with proper canonical tag. » Ce message, affiché dans le rapport de couverture de Search Console face à une quarantaine de fiches pratiques d’un site associatif, aurait dû concerner des pages réellement dupliquées. Le problème : chacune de ces quarante pages traitait un sujet distinct, rédigé indépendamment, sans le moindre paragraphe copié d’une fiche à l’autre.

Ce cas illustre un phénomène connu mais mal documenté : Google peut classer une page comme doublon d’une autre non pas à cause du texte qu’elle contient, mais à cause de la structure visuelle et technique du gabarit qui l’entoure, lorsque celui-ci laisse trop peu de place au contenu réellement variable.

Symptôme : des pages uniques traitées comme des variantes canoniques d’une autre

Le rapport de couverture indiquait, pour chacune des quarante pages concernées, qu’elle était considérée comme une page alternative disposant d’une balise canonique appropriée pointant vers une autre URL du même site. Or, aucune balise <link rel="canonical"> personnalisée n’avait été ajoutée manuellement sur ces pages : le thème générait par défaut une balise canonique auto-référencée, standard, cohérente pour chaque URL.

Ce message signifie en réalité que Google a lui-même choisi une autre URL comme canonique, en jugeant le contenu de la page suffisamment similaire à celui d’une autre pour ne pas justifier une indexation distincte, malgré l’absence de toute indication technique en ce sens de la part du site.

Diagnostic : un gabarit presque identique d’une fiche à l’autre

L’inspection manuelle de plusieurs paires de pages concernées a révélé le point commun : ces quarante fiches pratiques partageaient un gabarit avec très peu de texte réellement variable en dehors du corps principal de l’article. Le titre, l’introduction générique (« Cette fiche pratique vous guide pas à pas »), le pied de page identique sur toutes les pages, et un encart de liens connexes strictement identique, représentaient collectivement une proportion importante du texte visible de chaque page, comparée au volume du contenu réellement spécifique.

Une extraction du texte visible de dix pages, réalisée avec un script Python s’appuyant sur BeautifulSoup, a permis de calculer que la proportion de texte partagé (hors article central) représentait en moyenne 55 % du texte total de chaque page pour les fiches les plus courtes, celles dont l’article central ne dépassait pas 300 mots. Pour ces pages précisément, la similarité structurelle l’emportait statistiquement sur la spécificité du contenu, ce qui explique le classement en doublon par l’algorithme de Google.

L'essentiel à retenir : Le rapport de couverture ne distingue pas duplication de contenu et duplication de structure ; Un gabarit trop similaire peut tromper l'algorithme de détection de doublons ; L'ajout d'un contenu structurant distinctif suffit souvent à lever le faux positif

Correctif : réduire le texte générique et enrichir le contenu spécifique

Trois actions ont été menées en parallèle sur les pages concernées :

  • Suppression de l’introduction générique répétée à l’identique, remplacée par une accroche rédigée spécifiquement pour chaque fiche ;
  • Réduction du bloc de liens connexes en pied d’article, limité à trois liens réellement pertinents pour le sujet plutôt qu’une liste fixe de dix liens identiques sur toutes les pages ;
  • Enrichissement du contenu central des fiches les plus courtes, avec un objectif minimal de 500 mots de texte spécifique, seuil empirique retenu après observation du comportement des pages non concernées par le problème.

Ce qui n’a pas fonctionné en première intention

Une première tentative, plus rapide à mettre en œuvre, a consisté à demander une nouvelle exploration des pages concernées via l’outil d’inspection d’URL de Search Console, sans modifier le contenu. Cette action n’a eu aucun effet : Google a maintenu son classement en doublon lors de la réexploration, confirmant que le problème résidait bien dans le contenu et la structure, pas dans une simple absence de prise en compte d’une mise à jour récente.

Résultat après réexploration

Six semaines après les modifications de contenu, une nouvelle demande d’indexation a été soumise pour l’ensemble des pages concernées. Trente-six des quarante pages sont repassées en statut indexé dans les semaines suivantes ; les quatre pages restantes, dont le sujet se recoupait effectivement de très près avec une autre fiche existante, ont été fusionnées en une seule page enrichie, jugée plus pertinente que le maintien artificiel de deux URL distinctes sur un sujet quasi identique.

Prévention

Depuis cet incident, tout nouveau gabarit de fiche pratique est audité avant mise en production pour vérifier que le volume de texte spécifique dépasse largement le volume de texte partagé issu du gabarit lui-même. Cette vérification, simple à automatiser via un script comparant le ratio texte central sur texte total, a été intégrée à la checklist de recette technique de l’agence.

En résumé

Un faux positif de contenu dupliqué ne provient pas toujours d’un texte réellement copié : un gabarit trop générique, avec trop peu de contenu variable par rapport à sa structure fixe, peut suffire à tromper l’algorithme de Google. Le réflexe à adopter face à ce message dans Search Console consiste à mesurer objectivement la proportion de texte spécifique d’une page avant de chercher une explication plus complexe.

Partager :

À propos de l'auteur

Clément Hadrot

Développeur WordPress, passionné par Elementor, le FSE et l’automatisation par IA.

Voir tous ses articles

Dans la même veine

À lire aussi