# llms.txt qui contredit le sitemap : lequel un agent doit-il croire

> Deux fichiers destinés aux robots peuvent lister des priorités différentes pour les mêmes contenus, sans qu'aucune norme ne tranche ce conflit.

- Auteur : Clément Hadrot
- Publié le : 2025-12-11
- Mis à jour le : 2025-12-11
- Catégorie : SEO &amp; GEO
- URL : https://wpmoderne.dev.wordpress-developpement.fr/seo/llms-txt-contredit-sitemap-conflit/

## L’essentiel

- Le sitemap XML et le llms.txt n'ont pas la même vocation ni la même fraîcheur
- Un contenu listé en priorité dans l'un peut être absent de l'autre
- Aucune norme officielle ne définit de hiérarchie entre les deux

Comparaison révélatrice : d'un côté, un sitemap XML généré automatiquement à chaque publication, listant plusieurs milliers d'URLs sans distinction de valeur. De l'autre, un fichier `llms.txt`, rédigé à la main quelques mois plus tôt, qui met en avant une sélection de douze articles jugés représentatifs du site au moment de sa création. Le format llms.txt existe depuis septembre 2024 et propose une liste éditorialisée de ressources, pensée pour orienter un agent conversationnel vers le contenu le plus pertinent.

Le problème apparaît quand ces deux fichiers cessent d'être synchronisés. Le sitemap continue de s'enrichir automatiquement, article après article, pendant que le llms.txt reste figé sur sa sélection initiale. Un agent qui lit les deux fichiers pour un même site se retrouve face à deux versions différentes de ce qui compte : l'une exhaustive et neutre, l'autre sélective et déjà datée.

## Deux fichiers, deux vocations différentes

Le sitemap XML répond à une norme technique ancienne et bien établie : il liste des URLs, une date de dernière modification, parfois une fréquence de mise à jour, sans aucun jugement de valeur sur le contenu. Il est conçu pour l'exhaustivité et généré automatiquement par la quasi-totalité des sites.

Le llms.txt répond à un objectif différent : offrir un point d'entrée court et lisible, en Markdown, qui présente le site et pointe vers ses ressources les plus utiles, à l'intention d'un agent qui dispose d'une fenêtre de contexte limitée. Sa valeur tient justement à sa sélectivité, ce qui implique une maintenance humaine régulière que le sitemap n'exige pas.

- Le sitemap est exhaustif, généré automatiquement, sans hiérarchie de valeur.
- Le llms.txt est sélectif, rédigé manuellement, pensé pour une lecture rapide.
- Aucun des deux ne remplace l'autre : ils répondent à des besoins différents.

## Le conflit concret observé sur un site technique

Sur le site étudié, un article publié en octobre, devenu la ressource de référence sur un sujet précis grâce à plusieurs mises à jour, figurait dans le sitemap avec une date de modification récente, mais restait absent du llms.txt rédigé en juin. À l'inverse, deux articles cités dans le llms.txt avaient depuis été fusionnés dans un contenu plus complet, et leurs URLs d'origine renvoyaient désormais une redirection.

> L'essentiel à retenir : Le sitemap XML et le llms.txt n'ont pas la même vocation ni la même fraîcheur ; Un contenu listé en priorité dans l'un peut être absent de l'autre ; Aucune norme officielle ne définit de hiérarchie entre les deux

```
# Extrait du llms.txt, rédigé en juin
## Ressources principales
- [Guide sitemap WordPress](/guide-sitemap-wordpress/): présentation complète
- [Guide flux RSS](/guide-flux-rss/): configuration de base
```

Ces deux liens, valides au moment de la rédaction, pointaient six mois plus tard vers des redirections, alors que le sitemap, régénéré automatiquement à chaque modification, ne contenait plus que les nouvelles URLs fusionnées.

### Quel fichier un agent doit-il privilégier ?

Aucune spécification officielle ne tranche cette question, et c'est précisément ce qui rend le sujet délicat. Un agent bien conçu devrait, en toute logique, considérer le sitemap comme la source de vérité sur l'existence et la fraîcheur d'une URL, et le llms.txt comme une couche éditoriale d'orientation, à condition qu'elle reste cohérente avec cette réalité technique.

## Réduire le risque de divergence

1. Ajouter la mise à jour du llms.txt à la liste de vérifications d'une refonte ou d'une fusion de contenus.
2. Vérifier périodiquement, par un script simple, que chaque URL citée dans le llms.txt renvoie un code 200 et figure dans le sitemap courant.
3. Éviter de citer une URL précise dans le llms.txt si son contenu est susceptible d'être restructuré à court terme.

```
curl -s -o /dev/null -w "%{http_code} %{url_effective}\n" https://exemple.fr/guide-flux-rss/
```

> Un llms.txt qui ment sur l'état réel du site nuit davantage qu'un llms.txt absent : il envoie un agent vers une impasse plutôt que de le laisser découvrir le sitemap seul.

## En résumé

Tant qu'aucune norme ne définit de hiérarchie explicite entre sitemap et llms.txt, la responsabilité de la cohérence retombe entièrement sur l'éditeur du site. Traiter le llms.txt comme un document vivant, révisé à chaque changement structurel important, évite qu'il ne devienne une source d'information contradictoire plutôt qu'un guide utile pour les agents qui le consultent.
