llms.txt : ce qu'il fait, qui le lit
llms.txt est un fichier texte placé à la racine d'un site (/llms.txt). Il résume le site et liste ses pages importantes, pour qu'un modèle de langage ou un agent trouve vite ce qui compte. Ce n'est pas une norme : c'est une proposition, et Google Search a écrit le 15 juin 2026 qu'il l'ignore.
Le fichier ne remplace donc pas des pages qu'une machine peut lire et attribuer. C'est ce que l'audit de contenu et de crédibilité regarde en premier, avant de relever si le fichier existe.
Ce que contient le fichier
Le format a été proposé le 3 septembre 2024 par Jeremy Howard. Il n'est porté ni par le W3C ni par l'IETF, qui publient les normes du web : c'est une convention, que chacun adopte ou non.
Le fichier est écrit en Markdown, un texte lisible tel quel par une personne comme par un programme. Seul le titre est obligatoire. Viennent ensuite, dans l'ordre :
- un titre, le nom du site ou du projet ;
- un court résumé, présenté en citation ;
- au besoin, quelques paragraphes de précisions ;
- des sections titrées qui listent des liens, chacun suivi d'une brève description ;
- par convention, une section « Optional » pour ce qu'un agent peut laisser de côté quand il manque de place.
La proposition vise d'abord les agents qui consultent un site au moment de répondre, en particulier les assistants de programmation qui cherchent une documentation. Elle ne parle pas de classement dans un moteur de recherche.
Un fichier réel : celui de ce site
Ce site publie son llms.txt. Il tient en un paragraphe de résumé et une liste de liens. Le résumé dit qui vend (une société française, avec son numéro SIREN), ce que couvre l'audit, comment les pages sont examinées, ce qui est livré et quand le paiement est encaissé. Les liens mènent à l'offre, à la méthodologie, aux tarifs, aux questions fréquentes et aux exemples de rapports, chacun avec un libellé qui dit ce qu'on y trouve. Le fichier ne donne aucun prix : il renvoie à la page des tarifs, qui fait foi.
Le site existe en français et en anglais. Le format ne prévoit qu'un fichier à la racine : le nôtre commence par la version anglaise, puis ajoute une section « Français » avec les adresses de l'autre langue.
Notre premier fichier était écrit à la main. Il a vite annoncé « la note de méthode » quand le site disait « la note de méthodologie ». Personne ne le lit à l'écran, donc personne ne l'a vu. Il est désormais produit à partir des mêmes textes que les pages, et change avec eux.
Qui le lit, qui l'ignore
Google Search l'ignore. Son guide d'optimisation pour l'IA générative écrit qu'il est inutile de créer des fichiers lisibles par machine ou des fichiers textuels d'IA pour apparaître dans la recherche Google, AI Overviews et mode IA compris, « car la recherche Google elle-même ne les utilise pas ». Il précise qu'un tel fichier n'a « aucune incidence » sur la visibilité ou le classement. Google a ajouté cette note le 15 juin 2026.
Le même guide dit qu'on peut tout à fait garder le fichier pour d'autres services qui l'utilisent. Il n'interdit rien : il dit que Search n'en tient pas compte.
Chrome, lui, le vérifie. L'outil d'audit intégré au navigateur a une catégorie expérimentale consacrée aux agents, et sa documentation décrit llms.txt comme une « convention émergente ». Un fichier absent y est classé non applicable, puisque le fournir reste facultatif. Seule une erreur du serveur est signalée.
Pour les autres assistants, nous n'avons pas trouvé de documentation officielle qui dise s'ils lisent le fichier pour composer leurs réponses, ni comment.
Ce qui compte davantage pour être lu par une IA
Le même guide de Google rappelle que ses fonctions d'IA générative s'appuient sur l'index de la recherche. Une page n'y apparaît que si elle est indexée et peut s'afficher avec un extrait. Ce qui aide vient donc des pages elles-mêmes, pas d'un fichier à part :
- un contenu que les robots peuvent explorer, et qui reste lisible quand le JavaScript ne s'exécute pas ;
- des consignes claires aux robots dans le fichier robots.txt, y compris ceux des sociétés d'IA ;
- des pages organisées en sections, avec des intertitres qui disent ce qu'elles contiennent ;
- un contenu qui apporte un point de vue ou une expérience propre, et pas le résumé de ce qui existe ailleurs ;
- une page qui dit qui l'a écrite et qui publie le site, ce que Google appelle l'E-E-A-T.
Google ajoute que les données structurées ne sont pas requises pour ses fonctions d'IA, et qu'aucun balisage spécial n'est nécessaire. Elles restent utiles pour les résultats enrichis.
Ce que l'audit vérifie
L'audit cherche llms.txt à la racine du site, ainsi que ses variantes llms-full.txt et ai.txt. Une réponse positive ne suffit pas. Beaucoup de sites renvoient leur page d'accueil pour n'importe quelle adresse : un llms.txt qui répond par une page du site n'existe pas. L'audit compare donc la réponse à celles d'adresses qui ne peuvent pas exister, et regarde son type et sa taille. Seul un vrai fichier texte, distinct de la page de repli, compte comme publié.
L'audit relève aussi ce que votre robots.txt dit aux robots des sociétés d'IA : autorisés, bloqués, ou non mentionnés. C'est un choix éditorial : le rapport le décrit sans le noter.
Un fichier absent n'est pas une faute : aucune règle du barème ne le pénalise. Sa présence compte parmi les signaux de lisibilité par les agents, avec un poids faible. Ce qui pèse dans ce pilier, ce sont les pages : ce qu'un système automatisé peut y lire, en extraire et vous attribuer.
Ce que cette vérification ne dit pas
Nous vérifions la présence et la forme du fichier. Son effet sur les réponses des IA ne se mesure pas de l'extérieur : nous ne savons pas quels systèmes le lisent chez vous, ni ce qu'ils en font.
Aucun audit ne peut promettre qu'un assistant citera votre site. Nous relevons ce qui rend une page lisible et attribuable par une machine, pas le comportement d'un système que nous ne contrôlons pas.
À lire ensuite
Données structurées : ce qui sert encore
Organization, WebSite, BreadcrumbList, Article, Product : les données structurées qui servent encore, et pourquoi elles doivent dire la même chose que la page.
Lire le guide →E-E-A-T : ce que Google entend par là
Expérience, expertise, autorité, fiabilité : ce que Google met derrière E-E-A-T, pourquoi ce n'est pas un score, et ce qui le rend visible sur une page.
Lire le guide →Site multilingue : le contenu non traduit
Un intertitre, un message du thème, un bloc ajouté après coup : où se cache le contenu non traduit d'un site multilingue, et ce que l'audit compare.
Lire le guide →