VisibilityReport

Guide · septembre 2026

llms.txt : ce que c’est, qui le lit vraiment et si vous en avez besoin

llms.txt est un fichier Markdown placé à la racine d’un site, qui donne aux systèmes d’IA une carte sélective de vos contenus les plus importants. Il se crée en une après-midi, il ne peut pas vous nuire, et l’honnêteté oblige à le dire d’emblée : aucun fournisseur d’IA majeur n’a confirmé l’utiliser pour la recherche ou pour ses réponses générées.

Ce paradoxe résume tout l’article. Nous expliquons ici ce qu’est ce fichier, en quoi il diffère de robots.txt, ce que disent les études de 2026 sur qui le lit réellement, où il rend vraiment service, et comment le construire correctement si vous décidez que l’après-midi en vaut la peine.

Qu’est-ce que llms.txt ?

llms.txt est une convention web proposée : un fichier Markdown servi à l’adresse /llms.txt, qui résume ce qu’est un site et renvoie vers ses pages les plus importantes, sous une forme que les modèles de langage peuvent lire efficacement.

L’idée a été proposée en septembre 2024 par Jeremy Howard, cofondateur d’Answer.AI, et elle est documentée sur llmstxt.org. Le problème qu’elle adresse est réel : les modèles de langage travaillent avec une fenêtre de contexte limitée, et les pages HTML modernes enterrent le contenu utile sous la navigation, les scripts, les bannières de cookies et le balisage. Un fichier Markdown unique et propre permet à un système d’IA de saisir la structure d’un site, et d’en trouver la substance, sans avoir à traverser tout cela.

La proposition est vivante : la version 2 de la spécification est arrivée en août 2026, avec la prise en charge de fichiers llms.txt sur des sous-chemins (comme /docs/llms.txt) et des façons standard, pour les pages, de pointer vers leur version Markdown.

En quoi llms.txt diffère-t-il de robots.txt et sitemap.xml ?

Les trois fichiers placés à la racine répondent à trois questions différentes, et les confondre est le malentendu le plus courant autour de llms.txt :

FichierQuestion à laquelle il répondFormatStatut en 2026
robots.txt« Quels robots peuvent récupérer quelles URL ? »Règles en texte brutNorme établie (RFC 9309), respectée par les grands robots
sitemap.xml« Quelles URL existent, et quand ont-elles changé ? »XMLNorme établie, utilisée par les moteurs de recherche
llms.txt« Qu’est-ce qui compte sur ce site, sous une forme qu’un modèle de langage peut assimiler ? »MarkdownConvention proposée : aucun support confirmé des grands fournisseurs d’IA

La différence essentielle : llms.txt n’autorise ni ne bloque rien. Il ne détermine pas si les entreprises d’IA explorent votre site ou s’entraînent sur son contenu : c’est le rôle de robots.txt et de votre protection anti-robots. llms.txt est une pure invitation : « si vous voulez comprendre ce site, commencez ici ».

À quoi ressemble un fichier llms.txt ?

Le format est volontairement simple : un H1 avec le nom du site (seul élément obligatoire), une citation d’un paragraphe qui résume le site, puis des sections H2 contenant des listes de liens, chacun accompagné d’une description d’une ligne, optionnelle. Une section nommée « Optional » signale un contenu que l’IA peut ignorer quand le contexte se fait rare.

Voici un exemple complet pour une boutique en ligne fictive :

# Example Store

> Example Store is a Berlin-based online retailer of trail-running and
> hiking gear, shipping across the EU in 1–3 business days, with free
> 30-day returns.

## Products
- [Trail running shoes](https://www.example-store.com/trail-shoes.md): Full catalog with sizing, drop and weight specifications
- [Hiking backpacks](https://www.example-store.com/backpacks.md): 20–60 L packs with a fit guide

## Customer service
- [Delivery and returns](https://www.example-store.com/delivery.md): Shipping times, costs and the 30-day return process
- [Size guide](https://www.example-store.com/size-guide.md): Measurements and conversion charts

## Company
- [About us](https://www.example-store.com/about.md): Company history, contact details and physical stores

## Optional
- [Blog](https://www.example-store.com/blog.md): Buying guides and gear reviews

Deux conventions complémentaires prolongent l’idée. Les pages liées peuvent proposer une version Markdown d’elles-mêmes (la même URL, avec .md ajouté en suffixe), pour qu’une IA lise le texte propre plutôt que le HTML. Et beaucoup de sites publient un llms-full.txt : un unique fichier volumineux contenant le contenu complet de chaque page clé, pour les systèmes qui préfèrent tout ingérer d’un coup.

Les systèmes d’IA lisent-ils vraiment llms.txt ?

Globalement non, et c’est là que la plupart des articles sur llms.txt manquent d’honnêteté. En 2026, aucun fournisseur d’IA majeur n’a confirmé lire llms.txt en production, que ce soit pour la recherche, les réponses générées ou l’entraînement de ses modèles. Concrètement, llms.txt n’améliore ni votre classement dans les résultats de recherche, ni votre visibilité dans les réponses des IA génératives.

Google a été explicite. Le porte-parole recherche John Mueller a comparé llms.txt à la balise meta keywords, cette étiquette auto-déclarée que les moteurs de recherche ont appris à ignorer il y a des décennies, parce que les propriétaires de sites pouvaient y écrire n’importe quoi. En juillet 2025, Gary Illyes, de Google, a confirmé que Google ne prenait pas en charge llms.txt et ne prévoyait pas de le faire. OpenAI et Anthropic documentent robots.txt, pas llms.txt, comme moyen de gérer leurs robots.

Les journaux serveur confirment ce constat. Une analyse d’Ahrefs portant sur 137 000 sites, en mai 2026, a montré que 97 % des fichiers llms.txt n’avaient reçu aucune visite de robot d’IA. Et une étude de SE Ranking sur environ 300 000 domaines a trouvé un taux d’adoption d’environ 10 %, mais aucune relation statistiquement significative entre la présence du fichier et la fréquence à laquelle un domaine est cité dans les réponses IA.

L’argument que l’on croise dans certains discours commerciaux, « ajoutez llms.txt et l’IA vous recommandera », ne repose donc sur aucune preuve. Quiconque le promet vend de l’espoir, pas des données.

Alors pourquoi des entreprises sérieuses en publient-elles un quand même ?

Parce qu’il existe deux façons bien différentes dont une IA touche votre site, et llms.txt n’a jamais vraiment été conçu pour la première.

L’exploration systématique est ce que font les moteurs de recherche et les pipelines d’entraînement : à grande échelle, méthodique, tout indexer. Ce monde-là fonctionne avec robots.txt et les sitemaps, et il ignore llms.txt : c’est justement ce que mesurent les études de journaux serveur.

La récupération à la demande est ce que font les agents et assistants IA : une personne pose une question, et le système va chercher, à cet instant précis, une poignée de pages pour y répondre. Dans ce moment-là, une carte Markdown bien construite rend un vrai service : elle indique à l’agent où se trouve la substance avant qu’il ne dépense son contexte limité sur votre menu de navigation. C’est pour cela que llms.txt a trouvé une adoption réelle dans la documentation technique : Anthropic en publie un pour sa propre documentation et recommande la convention dans ses conseils de rédaction pour les agents, OpenAI diffuse des fichiers llms.txt pour sa documentation développeurs, et les plateformes de documentation en génèrent automatiquement.

Pour résumer honnêtement : llms.txt ne fait rien pour la visibilité IA d’aujourd’hui dans la recherche, et quelque chose pour le web piloté par agents, encore en train de se former. À mesure que les agents IA qui recherchent, comparent et achètent au nom d’un utilisateur deviennent la norme, une porte d’entrée lisible par les machines est un pari petit et peu coûteux sur cet avenir : rien de plus, rien de moins.

Faut-il ajouter un fichier llms.txt à votre site ?

Oui, si vous le considérez comme un travail de fond peu coûteux d’une après-midi. Non, si vous en attendez un effet sur votre visibilité IA.

L’argument pour : cela ne coûte presque rien, cela ne comporte aucun risque de pénalité ou de spam, le rédiger vous oblige à décider quelles sont vraiment vos pages les plus importantes, et le fichier sera prêt le jour où un agent ira le chercher. Dans notre audit de 99 boutiques en ligne norvégiennes (en norvégien), mené en août 2026, seules 4 des 78 sites que notre robot a pu lire en possédaient un : l’adoption reste proche de zéro chez les entreprises ordinaires, ce qui laisse encore une place facile à prendre pour qui s’y met tôt.

L’argument contre y consacrer plus d’une après-midi : le retour mesurable est nul aujourd’hui, et un llms.txt que personne n’entretient pourrit tranquillement en une liste de liens morts et d’affirmations dépassées, servie aux machines avec un excès de confiance.

La priorité compte plus que le fichier. Ce qui détermine si les systèmes d’IA vous citent, c’est un contenu construit comme des réponses et une marque que des sources dignes de confiance mentionnent, comme nous le montrons dans notre guide SEO, AEO, GEO et AIO. llms.txt appartient à cette même famille de mesures techniques que les données structurées : utiles en fondation, jamais suffisantes seules. Il se place à la fin de la liste des priorités, pas au début. Écrivez d’abord le contenu citable, puis consacrez l’après-midi au fichier.

Comment créer un fichier llms.txt, étape par étape ?

  1. Listez vos pages vraiment importantes. Celles qui répondent aux questions des clients : produits, livraison, retours, tarifs, à propos. Dix à trente liens suffisent largement : c’est une carte sélective, pas un plan de site complet.
  2. Rédigez le H1 et le paragraphe de résumé en citation. Un paragraphe qui dit ce qu’est le site, pour qui, et ce qui le distingue. Le concret l’emporte sur le promotionnel : « livraison dans l’UE en 1 à 3 jours ouvrés » vaut plus que « votre partenaire de confiance ».
  3. Regroupez les liens sous des sections H2, avec une ligne de description par lien. Placez les sections les plus importantes en premier, et déplacez le contenu accessoire sous un titre « Optional ».
  4. Vérifiez la cohérence avec robots.txt. Ne mettez pas en avant, dans llms.txt, des pages que votre protection anti-robots interdit aux robots d’IA de récupérer : une carte sélective vers des portes verrouillées ne sert à personne.
  5. Publiez-le à la racine de votre domaine, à l’adresse `votredomaine.com/llms.txt`, en texte UTF-8 brut. Aucune inscription ni service de validation n’est nécessaire, même si les exemples de format proposés sur llmstxt.org valent la peine d’être reproduits à l’identique.
  6. Intégrez-le à votre routine de maintenance. Révisez-le chaque fois que les prix, les politiques ou les pages clés changent, comme vous le feriez pour un plan de site. Un fichier obsolète est pire que l’absence de fichier.
  7. Optionnellement, allez plus loin : publiez des versions Markdown des pages clés et un llms-full.txt. Cela vaut le coup pour les sites très documentaires, c’est excessif pour la plupart des boutiques.

Questions fréquentes

llms.txt est-il une norme web officielle ?

Non. llms.txt est une proposition communautaire de septembre 2024, documentée sur llmstxt.org. Aucun organisme de normalisation ne l’a adopté, et aucun fournisseur d’IA n’est tenu de le respecter. Cela ne le rend pas inutile pour autant : robots.txt a fonctionné par convention pendant des décennies. Mais les affirmations selon lesquelles ce serait une « norme » ou une « obligation » sont fausses.

llms.txt améliore-t-il mon classement Google ?

Non. Google a déclaré ne pas utiliser llms.txt pour la Recherche ou ses fonctionnalités IA, et John Mueller l’a publiquement comparé à la balise meta keywords, tombée dans l’oubli depuis longtemps. Toute promesse de classement associée à llms.txt doit être vue comme un signal d’alarme sur la personne qui la formule.

llms.txt empêche-t-il les entreprises d’IA de s’entraîner sur mon contenu ?

Non. llms.txt n’a aucune fonction de contrôle d’accès : il ne peut rien autoriser ni rien interdire. La possibilité, pour les robots d’IA, de récupérer votre site dépend de robots.txt et de votre protection anti-robots. Si votre objectif est de bloquer l’entraînement des IA, llms.txt n’est tout simplement pas le bon outil.

Quelle est la différence entre llms.txt et llms-full.txt ?

llms.txt est un index court : le résumé du site, plus des liens sélectionnés avec description. llms-full.txt en est le complément étendu : le contenu complet des pages clés, intégré dans un unique fichier Markdown volumineux, pour qu’un système puisse tout ingérer en une seule requête. La plupart des sites devraient commencer par llms.txt seul.

llms.txt vaut-il le coup pour un site de petite entreprise ?

En tant que tâche secondaire et peu coûteuse, oui. Cela prend une après-midi, cela ne comporte aucun risque, et cela prépare votre site aux agents IA qui récupèrent du contenu à la demande. Mais cela ne poussera pas les systèmes d’IA à vous recommander : ce sont un contenu clair, citable, et des mentions indépendantes de votre marque qui font ce travail. Commencez par cela.

Pour conclure

llms.txt n’est ni l’arme secrète que prétendent ses promoteurs, ni le pur gaspillage que dénoncent ses détracteurs. C’est une convention peu coûteuse et bien conçue, qui attend son écosystème : aujourd’hui, presque personne ne la lit, et demain, les agents qui navigueront au nom de vos clients le feront peut-être.

Cela rend la décision agréablement simple. Si une après-midi de travail vous offre une porte d’entrée propre et lisible par les machines, et vous oblige au passage à nommer vos pages les plus importantes, prenez cette après-midi. Faites-le simplement les yeux ouverts : ce fichier relève du travail de fondation, et les fondations ne gagnent pas la visibilité. Un contenu qui répond à de vraies questions, porté par une marque que d’autres sources mentionnent, fait tout ce travail-là.