Résumé de l'article
- En 2026, aucun gain de visibilité démontré : aucun moteur génératif ne confirme lire le fichier.
- Ahrefs, mai 2026 : 97 % des fichiers llms.txt publiés n’ont reçu aucune requête sur le mois.
- L’usage qui tient : donner un index propre à des agents qui explorent une documentation volumineuse.
- Sur WordPress, Yoast n’y met que 5 contenus et 5 taxonomies : préférez un fichier curé à la main.
- Pour la visibilité, le vrai levier reste robots.txt, avec une directive par user-agent IA.
Disons-le d’emblée : en 2026, rien ne démontre que le fichier llms.txt améliore la visibilité d’un site dans ChatGPT ou les AI Overviews, et les analyses de logs montrent que presque personne ne le lit. Il garde un usage réel, plus étroit : donner un index propre à des agents qui doivent explorer une documentation volumineuse. Voici ce qu’il fait vraiment, quand il sert, et sa syntaxe exacte.
llms.txt : qu’est-ce que c’est et à quoi sert ce fichier ?
Le fichier llms.txt est un fichier Markdown placé à la racine d’un site, qui liste sous forme d’index commenté les contenus qu’un modèle de langage devrait lire en priorité. Proposé par Jeremy Howard, fondateur d’Answer.AI, le 3 septembre 2024, il n’a aucune valeur contraignante. Contrairement à robots.txt, il n’interdit rien, et aucun moteur IA n’a confirmé le lire.
L’intention est technique : une page HTML noie l’information utile sous la navigation et le balisage, quand un index Markdown coûte peu de jetons.
Deux ans après sa proposition, le bilan est clair. Comme levier de visibilité, llms.txt ne fait pas ses preuves : aucun moteur génératif ne confirme le lire, et les relevés de logs publiés en 2026 ne montrent presque aucune requête sur les fichiers publiés. Comme index de documentation, il rend en revanche un vrai service à des agents qui doivent parcourir un corpus technique important. C’est ce second usage qui justifie encore de le déployer.
La spécification est passée en version 2 le 10 août 2026, d’après le site officiel llmstxt.org. Quatre changements comptent : des relations de lien pour la découvrabilité, deux formats d’URL Markdown, une couverture par sous-chemin, une section Optional vidée de sa mécanique.
Précision d’orthographe : ce fichier est souvent cherché sous le nom llm.txt. Le nom exact de la spécification est llms.txt, avec un s.
Ce que le fichier llms.txt n’est pas
Ce n’est ni un robots.txt, ni un sitemap.xml, ni un standard adopté. Il n’interdit aucune exploration et n’engage aucun éditeur de modèle. Ni OpenAI, ni Anthropic, ni Google, ni Perplexity n’a confirmé le consulter : une absence de confirmation, pas un démenti.
llms.txt, robots.txt et sitemap.xml : quelle différence ?
robots.txt autorise ou interdit l’exploration, sitemap.xml inventorie les URL à indexer, llms.txt recommande une sélection de contenus aux modèles de langage. Les deux premiers sont des standards suivis par les crawlers. Le troisième est une proposition sans adoption confirmée.
| Critère | llms.txt | robots.txt | sitemap.xml |
|---|---|---|---|
| Rôle | Recommander les contenus prioritaires | Autoriser ou interdire l’exploration | Inventorier les URL à indexer |
| Format | Markdown commenté | Texte, directives User-agent | XML |
| Emplacement | Racine ou sous-chemin | Racine uniquement | Libre |
| Contraignant | Non | Oui, pour les crawlers déclarés | Non |
| Adoption confirmée | Aucune | Standard depuis 1994 | Standard des moteurs |
Est-ce que llms.txt fonctionne vraiment ?
Non, pas pour la visibilité dans les réponses des IA. Trois analyses de logs indépendantes convergent : ces fichiers ne sont quasiment jamais requêtés. Le seul usage validé par les données concerne les agents qui lisent de la documentation technique.
En mai 2026, Ahrefs a analysé 137 210 domaines ayant reçu du trafic : 28 % publiaient un llms.txt valide, et 97 % de ces fichiers n’ont reçu aucune requête sur le mois. Parmi les requêtes effectivement reçues, 10,5 % viennent d’agents IA et d’infrastructure agentique, contre 1,1 % de robots de récupération.
En France, Daniel Roch (SEOMix) a suivi 6 sites pendant 60 jours, en avril et mai 2026 : 33 092 passages de robots IA, 2 249 URL explorées, zéro requête sur le fichier. Reboot Online a mené le même test sur deux sites pendant trois mois : aucun robot IA n’est venu chercher les pages référencées uniquement dans le fichier llms.txt.
Que disent Google, OpenAI et Anthropic du fichier llms.txt ?
Google est le seul à s’être exprimé. Le 15 juin 2026, l’entrée « Clarifying guidance on llms.txt files » est apparue dans son journal de mises à jour Search Central. Sa documentation sur les fonctionnalités IA est nette : « You don’t need to create new machine readable files, AI text files, or markup to appear in these features. »
La contradiction est interne à Google. Depuis le 7 mai 2026, la catégorie Agentic Browsing de Lighthouse 13.3.0 est active par défaut dans Chrome, et l’un de ses audits vérifie la présence du fichier. Search dit qu’il ne sert pas au référencement, Chrome l’audite pour la navigation agentique. OpenAI publie un llms.txt pour sa propre documentation, sans avoir jamais déclaré en consommer. Ni Anthropic ni Perplexity n’ont pris position publiquement sur ce fichier.
Quelle est la syntaxe exacte d’un fichier llms.txt ?
Le format est du Markdown en quatre parties : un H1 portant le nom du site, seule section obligatoire, un blockquote de résumé, des sections libres, puis des sections H2 listant des liens. Chaque lien s’écrit [nom](url), avec une note facultative après deux-points.
Voici le squelette, ligne par ligne.
| Ligne du fichier | Ce qu’elle fait |
|---|---|
# Ylly | H1 obligatoire, le nom du site. Seule section exigée. |
> Agence digitale B2B depuis 2009. | Résumé : ce qu’un modèle doit savoir pour lire la suite. |
Contenus en français. | Section libre : contexte, périmètre, langue. Pas de titre ici. |
## Expertises | H2 qui ouvre une liste de fichiers, une par famille. |
- [Méthodologie](https://ylly.fr/methodologie/): nos cinq étapes | Item : lien Markdown obligatoire, deux-points et note facultative. |
## Optional | Contenus secondaires. Depuis la v2, la section n’instruit plus les outils. |
llms.txt ou llms-full.txt : quelle différence ?
llms.txt est un index curé de liens, llms-full.txt concatène tout le texte du site dans un seul fichier Markdown. Ce que presque personne ne signale : le format llms full txt ne figure pas dans la spécification. C’est une convention Mintlify née fin 2024.
Où placer le fichier llms.txt et le rendre découvrable ?
À la racine, à l’adresse /llms.txt, servie en HTTP 200. Depuis la v2, il peut vivre dans un sous-chemin comme /docs/llms.txt : le plus spécifique s’applique.
Deux relations de lien de la v2 aident à la découvrabilité : alternate, avec le type text/markdown, pointe vers la version Markdown d’une page, describedby vers le fichier qui la couvre. Ajoutez enfin un en-tête X-Robots-Tag noindex sur /llms.txt, pour qu’il ne remonte pas dans les résultats de recherche. Le fichier n’est pas une page de contenu : ce rôle revient à une page lisible, comme notre page d’information à l’usage des moteurs IA.
Comment créer un fichier llms.txt sur WordPress ?
Trois voies existent : la fonction native de Yoast SEO, une extension dédiée, ou un fichier écrit à la main. La troisième donne le meilleur résultat : la valeur du fichier tient à la curation.
| Méthode | Ce qu’elle produit | Sa limite |
|---|---|---|
| Yoast SEO, fonction native | Les 5 derniers contenus et les 5 taxonomies les plus fournies, régénérés chaque semaine | 5 contenus et 5 taxonomies de moins de 12 mois : très pauvre |
| Extension dédiée | Génération automatique, fréquence paramétrable, respect des noindex de Yoast, Rank Math, SEOPress et AIOSEO | Exhaustivité subie : un second sitemap, sans hiérarchie |
| Fichier écrit à la main | Un index restreint aux pages qui portent l’information, avec une note par lien | Demande un arbitrage éditorial, puis une maintenance |
Les outils en ligne de type llms.txt generator produisent un fichier valide en quelques secondes. Ils ignorent vos pages stratégiques : relisez leur sortie.
Sur un site unique, l’opération tient dans une session de travail. Sur un parc, elle change de nature. Chryso publie plus de 20 sites de filiales sur l’usine à sites WordPress que nous avons construite : autant de fichiers à tenir à jour.
Comment maintenir un fichier llms.txt dans le temps ?
Régénérez le fichier après chaque changement d’arborescence, et contrôlez deux fois par an les codes HTTP des URL listées. Un fichier périmé est pire qu’un fichier absent : il envoie des liens morts et décrit un site qui n’existe plus.
- Rédiger le fichier à partir des pages qui portent l’information, pas du sitemap.
- Le publier à la racine, vérifier qu’il répond en HTTP 200.
- Ajouter l’en-tête X-Robots-Tag noindex.
- Déclarer les relations de lien de la v2 sur les pages concernées.
- Contrôler les liens deux fois par an, régénérer après toute refonte.
Ce coût récurrent est le vrai critère de décision. Faible sur un site institutionnel, réel sur un site à forte production éditoriale, il se multiplie sur un parc. Nous le traitons dans nos contrats de maintenance comme le sitemap.
robots.txt et crawlers IA : le vrai levier complémentaire
Le fichier robots.txt reste le seul levier à effet vérifiable sur les robots des IA. Il autorise ou interdit l’accès robot par robot, et les principaux éditeurs publient leurs user-agents. Encore faut-il tous les nommer.
| User-agent | Éditeur | Fonction déclarée |
|---|---|---|
| GPTBot | OpenAI | Entraînement des modèles |
| OAI-SearchBot | OpenAI | Recherche dans ChatGPT |
| ChatGPT-User | OpenAI | Page ouverte à la demande d’un utilisateur |
| ClaudeBot | Anthropic | Entraînement des modèles |
| Claude-SearchBot | Anthropic | Recherche dans Claude |
| Claude-User | Anthropic | Page ouverte à la demande d’un utilisateur |
| Google-Extended | Usage du contenu par Gemini | |
| PerplexityBot | Perplexity | Indexation pour Perplexity |
Deux pièges. Bloquer ClaudeBot ne bloque ni Claude-SearchBot ni Claude-User : chaque robot exige sa directive User-agent. Et OpenAI précise pour ChatGPT-User que les règles de robots.txt peuvent ne pas s’appliquer, l’action venant d’un humain.
L’hébergement compte aussi : depuis le 1er juillet 2025, Cloudflare bloque par défaut les robots IA sur tout nouveau domaine passant par son réseau.
Faut-il déployer llms.txt en 2026 ? Notre retour d’expérience
Oui si vous publiez de la documentation technique lue par des agents, non si vous en attendez un gain de visibilité dans ChatGPT ou les AI Overviews. Le fichier ne coûte presque rien et ne rapporte rien de mesurable.
Nous l’avons déployé, chez nous comme chez des clients. Notre position n’a pas bougé : un pari à coût faible, pas un levier d’acquisition. Nous n’avons observé aucun gain de trafic attribuable au fichier.
Ce que nous en retirons est ailleurs, et c’est le cas d’usage que nous recommandons. Sur un site qui publie de la documentation, un index Markdown curé fait gagner du temps à un agent qui doit retrouver la bonne procédure : il lui évite de traverser des dizaines de gabarits HTML pour atteindre trois pages utiles. Le bénéfice est opérationnel, pas promotionnel.
C’est particulièrement vrai sur les projets à forte documentation technique. Sur une usine à sites qui dessert des dizaines de filiales, chaque entité publie ses propres procédures, guides d’administration et référentiels produits ; un index unique à la racine donne aux agents internes un point d’entrée stable, là où le plan du site public ne dit rien de cette hiérarchie. Même logique pour un extranet documentaire ou un centre d’aide produit.
Écrire ce fichier oblige par ailleurs à répondre à une question saine : quelles pages portent vraiment l’information de ce site ? Cet exercice de curation sert l’architecture et la refonte.
Ce qu’il ne faut pas en attendre : un effet sur le classement, une garantie d’être cité, une protection contre l’entraînement. Ces sujets se traitent avec un contenu structuré, des sources citables et un robots.txt à jour. Nous détaillons la mécanique dans notre guide pour optimiser sa visibilité dans ChatGPT et les AI Overviews, et dans notre offre SEO et GEO.
Questions fréquentes
C’est quoi le fichier llms.txt ?
C’est un fichier Markdown placé à la racine d’un site, qui liste les contenus qu’un modèle de langage devrait lire en priorité. Proposé par Jeremy Howard le 3 septembre 2024, il est passé en version 2 en août 2026.
Google utilise-t-il le fichier llms.txt ?
Non. Le 15 juin 2026, Google a publié une clarification indiquant que ces fichiers ne sont pas nécessaires pour Search. Sa documentation précise qu’aucun fichier lisible par machine n’est requis pour ses fonctionnalités IA.
Quelle différence entre llms.txt et llms-full.txt ?
llms.txt est un index de liens commentés, llms-full.txt regroupe tout le texte du site dans un seul fichier. Seul le premier figure dans la spécification : le second est une convention Mintlify pour la documentation technique.
Faut-il mettre un noindex sur son fichier llms.txt ?
Oui, via un en-tête HTTP X-Robots-Tag noindex appliqué à /llms.txt. Indexé, le fichier duplique vos titres et descriptions dans les résultats. Cette recommandation vient de la communauté SEO, pas de Google.
Comment ajouter un fichier llms.txt sur WordPress ?
Trois voies existent : la fonction native de Yoast SEO, une extension dédiée, ou un fichier écrit à la main et déposé à la racine. Yoast se limite à 5 contenus et 5 taxonomies, ce qui produit un index très pauvre. Le fichier curé à la main reste le plus utile, au prix d’une maintenance à prévoir.
Est-ce que les IA lisent vraiment le fichier llms.txt ?
Presque jamais, d’après les analyses de logs disponibles. Ahrefs a relevé en mai 2026 que 97 % des fichiers publiés n’avaient reçu aucune requête sur le mois. Les requêtes observées viennent surtout d’agents lisant de la documentation technique, pas des moteurs qui rédigent les réponses.