vendredi 25 septembre 2026

À propos

Contact

SEO & GEO

Antipatterns d’URL à paramètres : les filtres créent du duplicate content

Trier par prix, filtrer par couleur, paginer les résultats : chaque combinaison de filtres produit une URL indexable distincte pour un contenu quasi identique.

Par Clément Hadrot • 22 septembre 2021 • 4 min de lecture • Aucun commentaire
Antipatterns d'URL à paramètres : les filtres créent du duplicate content

Sur une boutique de vêtements en ligne, la page de catégorie « chaussures » propose des filtres de couleur, de taille et de prix, combinables librement par l’utilisateur. Chaque combinaison génère une URL du type /chaussures/?couleur=noir&taille=42, techniquement différente de la page de catégorie brute, mais dont le contenu affiché (les mêmes produits, simplement filtrés) ne varie que marginalement d’une combinaison à l’autre pour les filtres peu sélectifs.

Ce qu’on voit dans les rapports d’indexation

Un examen du rapport de couverture Search Console pour ce site a révélé plus de 12 000 URL indexées ou explorées sous la seule catégorie « chaussures », pour un catalogue réel de 340 références. La quasi-totalité de ces URL correspondaient à des combinaisons de filtres, dont beaucoup ne différaient entre elles que par l’ordre d’affichage de produits par ailleurs identiques, ou par un filtre trop peu restrictif pour changer réellement la liste affichée.

Pourquoi c’est un problème concret, pas seulement théorique

Trois conséquences mesurables découlent de cette prolifération d’URL :

  • Googlebot explore des milliers d’URL à faible valeur ajoutée, au détriment du temps consacré à explorer les vraies fiches produit ou les nouveaux articles publiés.
  • Le contenu quasi identique réparti sur des URL différentes dilue les signaux de pertinence que Google pourrait autrement concentrer sur une seule URL de référence par catégorie.
  • Certaines combinaisons de filtres peuvent, par accident, se positionner dans les résultats de recherche à la place de la page de catégorie principale, avec un titre et une méta-description générés dynamiquement et peu engageants pour un clic.
L'essentiel à retenir : Chaque combinaison de filtres peut générer une URL techniquement unique ; Un contenu identique à 95 % sur des milliers d'URL dilue la pertinence perçue ; Le noindex sur les combinaisons de filtres reste la correction la plus simple à mettre en place

Ce qu’on voit aussi côté structure technique

Sur ce projet, l’origine du problème remonte au thème de la boutique, qui générait les liens de filtre comme de simples liens <a href> classiques plutôt que de traiter les filtres en JavaScript côté client sans rechargement de page. Chaque clic sur un filtre créait donc un lien explorable et suivable par Googlebot, exactement comme n’importe quel lien de navigation normal du site.

Quoi faire : la correction retenue

La correction ne consiste pas à empêcher les filtres de fonctionner pour les visiteurs, mais à empêcher les combinaisons de filtres d’être traitées comme des pages à part entière par les moteurs de recherche. Deux mesures complémentaires ont été mises en place :

add_action( 'wp_head', function () {
    if ( is_tax( 'categorie_produit' ) && ( isset( $_GET['couleur'] ) || isset( $_GET['taille'] ) || isset( $_GET['prix'] ) ) ) {
        echo '<meta name="robots" content="noindex, follow" />' . "\n";
    }
}, 1 );

La balise noindex, follow plutôt qu’un blocage complet dans le robots.txt permet à Googlebot de continuer à explorer les liens produits présents sur ces pages filtrées, sans indexer la combinaison de filtres elle-même comme une page distincte. Cette approche a été choisie plutôt qu’un blocage par robots.txt, qui aurait empêché toute exploration, y compris des produits uniquement accessibles via un filtre spécifique.

Ce qui n’a volontairement pas été traité ici

La question de la balise canonique sur ces mêmes pages filtrées mérite un traitement à part entière, avec ses propres arbitrages sur la page de référence à désigner selon le type de filtre. Ce billet se concentre uniquement sur la réduction du volume de pages indexables générées par les filtres, pas sur la consolidation via canonical, qui répond à une logique différente et complémentaire.

Effet mesuré après trois mois

Le nombre de pages explorées quotidiennement sous forme de combinaisons de filtres a chuté de plus de 80 % selon les journaux serveur, et le rapport de couverture Search Console a progressivement retiré ces milliers d’URL de l’index, remplacées par une exploration plus concentrée sur les 340 fiches produit réelles et les pages de catégorie brutes.

Sur un site à filtres combinables, je vérifie systématiquement, dès la conception du thème, comment les liens de filtre sont générés : un lien classique cliquable et explorable n’est pas anodin, c’est un choix qui a des conséquences directes sur l’indexation.

Notre verdict

Les filtres de recherche à facettes sont un excellent outil pour l’expérience utilisateur, mais un piège classique pour l’indexation s’ils ne sont pas encadrés dès la conception. Une balise noindex, follow ciblée sur les combinaisons de filtres reste, dans la majorité des cas observés, la correction la plus simple et la plus rapide à mettre en œuvre sans sacrifier l’exploration des produits eux-mêmes.

Partager :

À propos de l'auteur

Clément Hadrot

Développeur WordPress, passionné par Elementor, le FSE et l’automatisation par IA.

Voir tous ses articles

Dans la même veine

À lire aussi