llms.txt est une idée simple entourée d'un battage médiatique démesuré : un fichier markdown à la racine de votre site qui offre aux grands modèles de langage une carte soignée de vos pages les plus importantes. Deux ans après la proposition, il est temps de poser les questions d'adulte. Qui l'a réellement adopté ? Existe-t-il des preuves que les systèmes d'IA le lisent ? Et si vous décidez d'en publier un, à quoi ressemble un bon fichier ?
Cet article s'en tient au vérifiable, renvoie aux données originales et reste honnête sur ce qui demeure inconnu. (Pour l'introduction destinée aux débutants, lisez d'abord Qu'est-ce que llms.txt ? — le présent article traite de l'état de l'adoption et des preuves en 2026.)
Récapitulatif en 60 secondes
Le standard a été proposé en septembre 2024 par Jeremy Howard d'Answer.AI (proposition originale ; spécification complète sur llmstxt.org). L'argument : les fenêtres de contexte sont limitées et les pages HTML encombrées de navigation, de scripts et de publicités — autant donner aux LLM un index markdown propre et organisé à l'adresse /llms.txt : un titre, un résumé d'un paragraphe et des listes groupées de vos pages clés avec une description d'une ligne. Un compagnon facultatif, llms-full.txt, intègre le contenu complet.
Contrairement à robots.txt, qui dit aux robots ce qu'ils ne peuvent pas lire, llms.txt dit aux systèmes d'IA ce qui mérite le plus d'être lu. L'un contrôle l'accès ; l'autre propose des priorités.
Adoption : une croissance réelle depuis une petite base
Les chiffres longitudinaux les plus cohérents proviennent de l'étude publique de suivi d'Originality.AI, qui surveille les fichiers llms.txt sur environ trois millions de sites web. Leur traqueur a recensé 4 088 fichiers llms.txt en juin 2025 et 36 120 en mai 2026 — une multiplication par 8,8 en douze mois (source).
Parmi les sites populaires, une exploration indépendante de mai 2026 des 10 000 premiers domaines Tranco a trouvé 586 fichiers llms.txt valides — soit 5,86 % d'adoption (source). La même étude contient un détail qui mérite qu'on s'y arrête : parmi toutes les URL renvoyant HTTP 200 pour /llms.txt, environ 64 % échouaient à la validation — redirections vers la page d'accueil, pages d'erreur HTML, fichiers vides. Compter naïvement les réponses 200 surestime l'adoption réelle de près de 3× ; méfiez-vous donc de tout titre sur l'adoption sans étape de validation.
Les adoptants penchent fortement vers la technique : les éditeurs d'outils pour développeurs, les sites de documentation et les startups IA dominent les annuaires publics (llmstxt.site, directory.llmstxt.cloud). Anthropic — l'entreprise derrière Claude — en publie un pour sa propre documentation sur docs.anthropic.com/llms.txt.
La question des preuves : quelqu'un le lit-il ?
Voici la partie honnête. À l'heure où nous écrivons, aucun grand fournisseur d'IA — OpenAI, Anthropic, Google, Perplexity — ne s'est publiquement engagé à consommer llms.txt dans ses systèmes de réponse en production.
Le sceptique le plus cité est John Mueller, de Google, qui écrivait en avril 2025 : « À ma connaissance, aucun service d'IA n'a déclaré utiliser llms.txt (et il suffit de regarder les logs de votre serveur pour constater qu'ils ne demandent même pas ce fichier). Pour moi, c'est comparable à la balise meta keywords » (via Search Engine Journal). Il a depuis ajouté un argument plus profond : comme llms.txt est auto-déclaré par le site qui veut être choisi, un LLM ne peut pas s'en servir pour départager des sites concurrents — chacun prétendrait simplement être le meilleur (source).
Le contrepoint, défendu par des praticiens (par exemple chez Search Engine Land), est que la comparaison de Mueller vise le classement, pas la compréhension : llms.txt n'a jamais été proposé comme signal de classement, mais comme une commodité pour les agents IA qui consultent votre site au moment de répondre — et c'est dans les logs de requêtes, pas dans les annonces officielles, que sa consommation apparaîtrait en premier. Les deux choses peuvent être vraies à la fois : le fichier peut aider un agent qui a déjà choisi de lire votre site, tout en ne faisant rien pour que les agents vous choisissent.
Ce que nous pouvons dire de notre poste d'observation chez RankedByAI, après avoir scanné de nombreux sites de petites entreprises : nous n'avons pas vu de preuve publique convaincante que publier un llms.txt, à lui seul, modifie la fréquence à laquelle une entreprise est mentionnée dans les réponses des IA. Si quelqu'un vous vend llms.txt comme une solution miracle de visibilité, gardez la main sur votre portefeuille.
Alors, faut-il en publier un ?
Notre position honnête : oui, si cela vous coûte dix minutes — et avec des attentes bien calibrées.
- Le coût est quasi nul. C'est un fichier texte statique. Pas de pénalité, pas d'impact sur le budget d'exploration, aucun inconvénient hormis la maintenance.
- Le bénéfice réaliste est la compréhension, pas le classement. Si un agent IA consulte votre site en répondant à une question, un index propre et organisé ne peut que l'aider à trouver plus vite vos services, vos implantations et vos preuves.
- Le bénéfice spéculatif est l'optionalité. Si un grand fournisseur se met à consommer le fichier, les adoptants précoces hériteront de l'avantage sans lever le petit doigt.
Ce que llms.txt ne remplace pas : des pages explorables (vérifiez votre robots.txt avec notre vérificateur de robots IA — un robot bloqué ne verra jamais votre llms.txt non plus), des pages de services claires, des avis et des mentions par des tiers. Ce sont toujours ces signaux qui font manifestement bouger les recommandations des IA.
Comment en écrire un bon
Le format, selon la spécification, est un markdown délibérément minimal :
- Un H1 avec le nom de votre site ou de votre entreprise — le seul élément obligatoire.
- Une citation juste après : une ou deux phrases résumant ce que vous faites, pour qui et où.
- Des sections H2 regroupant les liens — pour une entreprise, typiquement Services, Implantations, Preuves (avis, études de cas, certifications) et Contact.
- Chaque lien sur sa propre ligne :
[Titre de la page](URL) : description d'une ligne. - Une section facultative
## Optionalpour les liens secondaires qu'un agent peut ignorer quand le contexte est compté.
Les règles pratiques qui séparent les fichiers utiles des fichiers poubelles : restez sous quelques kilo-octets ; décrivez les pages factuellement plutôt que promotionnellement (souvenez-vous de l'argument de Mueller — l'autopromotion est invérifiable, donc ignorée) ; liez vos pages les plus pertinentes pour la décision, pas chaque URL de votre sitemap ; et mettez le fichier à jour quand vos pages changent, car un index périmé est pire que pas d'index du tout.
Vous pouvez écrire le fichier à la main dans n'importe quel éditeur de texte, en générer un depuis votre site en ligne avec notre générateur de llms.txt gratuit, ou utiliser la CLI open source (npx rankedbyai llms-txt votresite.com, code source sur GitHub), qui rédige un brouillon à partir de votre sitemap et des liens de votre page d'accueil.
FAQ
llms.txt améliore-t-il mon classement dans ChatGPT ou Perplexity ?
Aucune preuve publique ne l'indique, et aucun grand fournisseur d'IA n'a annoncé de prise en charge. Considérez-le comme une aide à la compréhension à faible coût pour les agents qui visitent déjà votre site, pas comme un levier de classement. Ce qui influence de façon mesurable les recommandations des IA : l'explorabilité, des pages factuelles claires, les avis et les mentions par des tiers.
Quelle est la différence entre llms.txt et robots.txt ?
robots.txt contrôle l'accès : il indique aux robots quels chemins ils peuvent ou non explorer, et les grands robots IA le respectent effectivement. llms.txt propose des priorités : il suggère quelles pages comptent le plus et résume votre site. L'un est appliqué, l'autre est consultatif — et sa consommation reste à ce jour non confirmée.
Ai-je aussi besoin de llms-full.txt ?
Probablement pas. La variante au contenu complet sert surtout aux sites de documentation dont toute la valeur est du texte qu'un agent pourrait vouloir en une seule requête. Pour un site d'entreprise classique, un fichier index bien organisé couvre le cas d'usage réaliste, et les données d'adoption montrent que la plupart font le même choix — dans l'exploration Tranco de mai 2026, environ un site sur six seulement parmi ceux ayant un llms.txt valide publiait aussi un llms-full.txt valide.
À quelle fréquence le mettre à jour ?
Chaque fois que les pages liées changent de manière significative — nouveaux services, nouvelles implantations, pages renommées. Une revue trimestrielle suffit pour la plupart des petites entreprises. Si vous générez le fichier avec un outil, régénérez-le après les mises à jour du site et comparez le résultat avant de publier.