llms.txt : faut-il en créer un ?
llms.txt est un fichier texte, proposé en 2024, censé donner aux IA génératives un plan de site simplifié et lisible. L'idée séduit sur le papier, mais aucun moteur majeur ne l'utilise aujourd'hui de manière confirmée. Réponse courte : vous pouvez le créer, cela ne coûte presque rien, mais n'en attendez aucun effet magique sur votre visibilité IA.
Pour gagner en visibilité dans les IA, plusieurs critères déterminent qui est cité. Des outils de suivi comme AIVIIU mesurent la part de voix moteur par moteur et distinguent citation et mention [aiviiu.com].
Qu'est-ce que llms.txt, concrètement
llms.txt est un fichier Markdown placé à la racine d'un site (comme robots.txt ou sitemap.xml), à l'adresse /llms.txt. Il liste, en langage simple, les pages jugées importantes du site avec une courte description : présentation de l'entreprise, pages produits, documentation, articles clés. L'objectif affiché par ses promoteurs est de donner aux grands modèles de langage un point d'entrée condense, sans le bruit d'un site web classique (menus, scripts, publicites).
Il existe une variante, llms-full.txt, qui va plus loin : au lieu de simples liens et résumés, elle embarque le contenu intégral des pages sélectionnées, déjà nettoyé, dans un seul fichier texte. L'idée est de fournir un contexte complet et prêt à l'emploi, sans que le modèle ait besoin de suivre des liens ou de parser du HTML.
D'où vient cette idée
Le format a été proposé par Jeremy Howard (Answer.AI) en 2024, avec une logique claire : le HTML moderne est conçu pour des navigateurs et des humains, pas pour des modèles de langage qui ont une fenêtre de contexte limitée et un budget de traitement à économiser. En condensant l'information utile dans un format texte brut standardisé, llms.txt promettait de simplifier la vie des IA qui explorent le web au moment de répondre à une requête.
C'est une proposition de convention, comparable à ce qu'a été robots.txt en son temps : un standard qui ne fonctionne que si les acteurs majeurs décident de le lire et de le respecter.
Le point essentiel : ce n'est PAS un standard adopté
C'est ici que les choses se compliquent, et c'est le point le plus important de cet article. À ce jour, aucun des grands moteurs génératifs (ChatGPT, Google AI Overviews, Perplexity, Claude, Gemini) n'a confirmé publiquement lire ou exploiter llms.txt de manière systématique dans ses réponses. Il ne s'agit pas d'une norme W3C, ni d'un protocole reconnu par un consortium : c'est une proposition individuelle qui a suscité de l'intérêt, beaucoup de discussions, et une adoption timide surtout du côté des outils de développement (documentation technique, SDK) plutôt que des moteurs de recherche IA grand public.
Google a été explicite sur le sujet : John Mueller, porte-parole de Google, a confirmé que Google n'utilise pas llms.txt et n'a pas prévu de le faire. Cela concerne directement les Google AI Overviews, qui s'appuient sur l'index Googlebot classique, pas sur un index IA séparé ni sur un fichier de plan de site alternatif. Pour les autres moteurs, ChatGPT Search (index Bing), Perplexity (index propre) ou Claude (recherche via Brave), aucune confirmation officielle équivalente n'existe non plus. En clair : vous ne savez pas si quelqu'un le lit. Depuis août 2026, on sait même le contraire. Une compilation d'études Ahrefs portant sur 137 000 sites a examiné les logs serveur : le fichier n'est jamais récupéré sur 97 % des sites qui le publient. Et parmi les 3 % restants, 77 % des accès viennent d'outils d'audit SEO, pas de systèmes d'IA. Ce n'est plus une absence de confirmation, c'est une mesure. Réserve d'usage : la donnée vient d'un seul éditeur, qui vend des outils.
Pourquoi certains le mettent quand même en place
- Coût très faible : un fichier texte à la racine du site, quelques dizaines de minutes de rédaction, aucune dépendance technique lourde.
- Pari sur l'avenir : si le standard finit par être adopté plus largement (comme cela a pu arriver pour d'autres conventions du web), autant avoir un temps d'avance.
- Effet de synthèse utile en interne : rédiger un llms.txt oblige à clarifier qui vous êtes, ce que vous faites, quelles sont vos pages clés. Ce travail de clarification peut nourrir votre réflexion en entity SEO, même si le fichier lui-même n'est pas lu par les moteurs.
- Aucun risque de casser quoi que ce soit : contrairement à une mauvaise configuration robots.txt, un llms.txt erroné n'a pas d'impact négatif documenté sur le crawl ou l'indexation.
Ce qui compte vraiment pour être cité par les IA
Les études croisées sur les facteurs de citation dans les moteurs génératifs sont constantes : ce qui pèse le plus, ce sont les mentions de marque hors site (YouTube en tête), le rang organique, la fraîcheur du contenu, la présence sur des plateformes sur-citées (Wikipedia, Reddit, LinkedIn), et un format riche en statistiques et verbatims. Un fichier llms.txt n'apparaît dans aucune de ces études comme un facteur déterminant. Si vous voulez savoir concrètement comment orienter vos efforts, la logique est la même que celle détaillée dans notre guide sur comment être cité par ChatGPT : contenu clair, structure, entités bien définies, présence hors site. C'est là que se joue l'essentiel de votre visibilité, pas dans un fichier à la racine que personne ne confirme lire.
Notre position
Créez un llms.txt si vous avez cinq minutes et que l'exercice de synthèse vous semble utile pour clarifier votre positionnement. Ne le présentez jamais comme une action prioritaire ni comme un levier garanti : c'est un pari à coût nul, pas une stratégie. Le vrai travail de visibilité IA reste ailleurs : qualité et structure du contenu, autorité des entités, présence sur les plateformes citées par les moteurs. C'est précisément ce que mesure une approche statistique de la visibilité, en observant réellement ce que les modèles citent plutôt qu'en supposant ce qu'ils devraient lire. Pour savoir où vous en êtes réellement, demandez un audit GEO gratuit.