Un site de recettes de cuisine, avec un moteur de recherche interne bien mis en avant sur la page d’accueil, remonte un symptôme inhabituel dans la Search Console d’un client : le rapport de couverture affiche plus de 900 pages indexées sous forme d’URL contenant /?s=, chacune avec un titre générique du type « Résultats de recherche pour “poulet” ». Aucune de ces pages n’apporte de valeur dans les résultats, et certaines cannibalisent même la visibilité d’articles de recettes bien plus pertinents pour les mêmes requêtes.
Symptôme : des pages sans intérêt qui grimpent dans l’index
Le déclencheur de l’alerte a été un pic inhabituel dans le rapport « Pages » de Search Console, section « Indexée, non soumise dans un sitemap ». En filtrant par motif d’URL, la quasi-totalité des pages concernées contenaient le paramètre s=. Un examen manuel de quelques-unes de ces pages sur Google, via l’opérateur site:, a confirmé leur présence effective dans l’index, avec parfois plusieurs dizaines d’impressions mensuelles chacune, un trafic fantôme qui ne convertit jamais.
Diagnostic : pourquoi ces pages ont fini par être indexées
L’inspection du code source de ces pages a révélé la cause : le thème du site liait en dur, dans un widget de la barre latérale, des suggestions de recherche vers des termes populaires (« recette rapide », « dessert facile »), créant ainsi des liens internes explicites vers des pages de résultats de recherche. Ces liens ont permis à Googlebot de découvrir et d’explorer ces pages normalement, puis de les indexer faute d’instruction contraire, WordPress ne posant aucune balise noindex par défaut sur son template de recherche.

Correctif : poser la balise au bon endroit
La correction consiste à injecter une balise meta robots sur le template de recherche, avant l’affichage de tout autre contenu du head. Une erreur fréquente est d’accrocher cette fonction trop tard, après que d’autres extensions ont déjà terminé leur sortie sur wp_head, ce qui n’empêche pas la balise d’apparaître mais complique sa lisibilité dans le code source lors des vérifications futures :
add_action( 'wp_head', function () {
if ( is_search() ) {
echo '<meta name="robots" content="noindex, follow" />' . "\n";
}
}, 1 );
Le choix de follow plutôt que nofollow n’est pas anodin ici : ces pages de recherche contiennent des liens vers de vraies fiches recettes, et couper le follow priverait ces fiches d’un signal de découverte supplémentaire, pour un bénéfice nul en contrepartie.
Retirer aussi les liens internes qui ont causé le problème
Poser la balise noindex ne suffit pas seul à traiter la cause racine : tant que le widget de suggestions continue de créer des liens explicites vers ces pages, Googlebot continuera de les explorer, ce qui consomme du budget de crawl même sans indexation. Le widget a été remplacé par des liens directs vers des pages de catégorie de recettes classiques, bien plus utiles à la fois pour les visiteurs et pour le maillage interne du site.
Accélérer la désindexation des pages déjà connues
Poser la balise ne suffit pas à faire disparaître immédiatement les 900 pages déjà indexées : Google doit revisiter chaque URL pour lire la nouvelle instruction, ce qui peut prendre plusieurs semaines au rythme naturel de crawl. Pour accélérer le processus sur les URL les plus visibles, l’outil de suppression d’URL de Search Console permet de demander un retrait temporaire pendant que la désindexation naturelle se fait en arrière-plan, une astuce utile pour les cas urgents.
Prévention pour la suite
Pour éviter la récidive sur ce projet, plusieurs mesures ont été ajoutées à la checklist de recette avant chaque mise en production :
- Vérification automatique qu’aucun widget ou menu ne crée de lien explicite vers une URL de recherche interne.
- Contrôle mensuel du rapport de couverture Search Console filtré sur le motif
?s=, pour détecter toute résurgence avant qu’elle ne prenne de l’ampleur. - Relecture systématique de tout nouveau widget de suggestions ou de contenu populaire avant sa mise en ligne, pour repérer ce type de lien caché.
Une balise noindex correctement posée dès la conception du thème coûte deux lignes de code ; la corriger après coup sur 900 pages déjà indexées demande un audit complet et plusieurs semaines de patience.
Bilan
Trois mois après l’intervention, le nombre de pages de recherche indexées est retombé à moins de dix, celles-ci correspondant à des URL encore en cours de réexploration par Google. Le trafic global du site n’a pas baissé, confirmant que ces pages fantômes n’apportaient aucune valeur réelle, seulement du bruit dans les rapports d’indexation.