Ahrefs a analysé 137 000 sites et constaté que 97 % des fichiers llms.txt n'ont reçu aucun trafic de la part des bots IA en mai 2026. Sur la même période, l'adoption du fichier a été multipliée par 8,8 en un an, passant de 4 088 sites en juin 2025 à 36 120 en mai 2026, selon l'étude de suivi d'Originality.ai portant sur trois millions de sites. Ces deux chiffres dessinent un paradoxe : un standard que presque aucun moteur IA ne lit aujourd'hui, adopté à grande vitesse par des équipes marketing qui croient en son utilité. Ce guide démêle cette contradiction.
Ce qu'est réellement llms.txt
llms.txt est un fichier Markdown placé à la racine d'un site web, à l'adresse votredomaine.com/llms.txt, qui fournit aux systèmes IA une carte organisée des pages les plus importantes du site, rédigée dans un format que les modèles de langage peuvent parcourir sans le bruit des menus de navigation, du JavaScript ou des bannières de cookies.
Jeremy Howard, cofondateur d'Answer.AI et fast.ai, a proposé ce standard en septembre 2024. Le problème qu'il cherchait à résoudre est réel : les pages web modernes sont bruyantes. Un modèle de langage qui tente de comprendre votre produit depuis votre page d'accueil doit traverser barres de navigation, bannières de cookies, contenus générés par JavaScript et textes promotionnels avant d'atteindre quoi que ce soit d'utile. Un fichier llms.txt va droit au but. C'est un briefing organisé, pas un sitemap.
Le format comporte quatre éléments. Un H1 avec le nom de votre site ou de votre marque. Un bloc de citation avec une à trois phrases décrivant ce que couvre le site et à qui il s'adresse. Des sections H2 regroupant les pages connexes par thème. Et des liens annotés au format [Titre](URL) : courte description de la page. C'est l'intégralité de la spécification. La mise en œuvre prend moins de 30 minutes pour la plupart des sites.
Améliore-t-il vraiment les citations IA ?
Non, pas aujourd'hui. Les preuves sur ce point sont inhabituellement claires pour un sujet GEO. Ahrefs a constaté que 97 % des fichiers llms.txt n'ont reçu aucun trafic de bots IA en mai 2026. OtterlyAI a conduit une expérience de 90 jours sur son propre site et n'a enregistré que 84 visites de bots IA sur /llms.txt, contre 62 100 hits totaux de bots IA, soit 0,1 % de toutes les requêtes de crawlers IA. SE Ranking a construit un modèle XGBoost sur des données de citations IA et a constaté que supprimer la variable llms.txt améliorait en réalité la précision de prédiction. Le fichier ajoutait du bruit plutôt qu'un signal. OtterlyAI a ensuite retiré llms.txt de sa liste de contrôle GEO au motif qu'il détournait l'attention des facteurs qui font réellement bouger le taux de citation.
Seules 7,4 % des entreprises du Fortune 500 avaient mis en place llms.txt en mars 2026, contre 92,8 % pour robots.txt, selon une étude de ProGEO.ai. Aucune des grandes plateformes IA (OpenAI, Google, Anthropic, Meta) n'a publiquement confirmé utiliser le fichier dans ses systèmes de citation en production. Les plateformes dont les produits de recherche génèrent les citations IA aujourd'hui concentrent leurs recommandations publiques sur robots.txt, la configuration des user agents et la structure du contenu. Pas sur llms.txt.
Pour améliorer votre taux de citation IA dès aujourd'hui, les actions à plus fort impact sont : autoriser les crawlers de récupération IA dans votre robots.txt, ajouter le balisage schema Organization et Article, et structurer votre contenu pour que chaque section s'ouvre sur une réponse autonome de 40 à 60 mots. Ce sont les signaux que les moteurs IA utilisent réellement. llms.txt n'en fait pas partie, du moins pas encore.
Où il fonctionne vraiment : le web agentique
Il existe un contexte où llms.txt a une valeur documentée et concrète : les assistants de code IA et les agents orientés développeurs. Des outils comme Cursor, GitHub Copilot et Claude récupèrent la documentation externe en temps réel lorsque des développeurs posent des questions sur un produit. Un fichier llms.txt aide ces outils à identifier les bonnes pages avec moins de gaspillage de tokens. Si votre site génère un trafic développeur significatif ou dispose d'une API publique, ce cas d'usage est réel.
L'analyse de Limy portant sur plus de 515 millions d'événements de trafic de bots LLM confirme que les bots qui génèrent les citations en recherche IA (GPTBot, ClaudeBot, PerplexityBot, OAI-SearchBot) ne demandent presque jamais /llms.txt. Mais Profound, une société spécialisée en suivi GEO, a signalé que les crawlers de Microsoft et d'OpenAI récupèrent activement les fichiers llms.txt et llms-full.txt. Google a par ailleurs intégré un fichier llms.txt dans son protocole Agents to Agents (A2A), ce qui suggère que ses équipes internes voient de la valeur dans cette convention pour la communication agent à agent, même si l'équipe Search ne l'utilise pas pour le classement.
Le cadrage qui résiste à l'examen : llms.txt n'est pas une tactique de citation en recherche IA. C'est une infrastructure pour le web agentique, la couche où les agents IA agissent pour le compte des utilisateurs, récupèrent du contexte et accomplissent des tâches. Cette couche se développe rapidement. Le coût de mise en place du fichier est négligeable. Les marques qui le traitent comme un investissement d'infrastructure optionnel mais propre font le bon choix. Celles qui y voient un levier de classement GEO dépensent une attention qu'elles devraient consacrer ailleurs.
Comment rédiger un fichier llms.txt correct
Le fichier comprend quatre éléments obligatoires ou fortement recommandés, dans cet ordre :
Un H1 avec le nom de votre marque ou de votre site. C'est le premier élément obligatoire de la spécification. Il doit apparaître en tête du fichier.
Un résumé en bloc de citation. Une à trois phrases couvrant ce que fait le site et à qui il s'adresse. Ce texte devient souvent le modèle mental de travail d'un LLM sur votre marque : rédigez-le de façon factuelle. "Plateforme IA révolutionnaire" ne dit rien à un modèle. "Plateforme SaaS B2B qui surveille les citations de marque sur ChatGPT, Perplexity et Gemini pour les équipes marketing et les agences" lui donne exactement ce dont il a besoin.
Des sections H2 regroupant les pages par thème. Organisez par ordre d'importance, pas selon la navigation de votre site. Le fichier d'une plateforme GEO peut comporter des sections Produit, Blog et Documentation. Commencez par vos sections les plus autoritaires : les modèles lisent de haut en bas et accordent plus de poids au contenu en début de fichier.
Des liens annotés au format exact : - [Titre](URL) : description. La description après les deux-points est l'élément le plus souvent négligé. Rédigez une phrase factuelle et spécifique pour chaque page. "Tarifs" est une description faible. "Comparatif des plans avec les limites de suivi par moteur et les tarifs mensuels" est précis et utile. Les agents parsent cette structure : toute déviation rompt l'analyse.
Deux erreurs fréquentes à éviter : ne listez pas toutes les URL du site. llms.txt est un briefing organisé, pas un second sitemap. Les pages de mentions légales, d'archives et de tags appartiennent à une section Optional en bas du fichier, si tant est qu'elles y figurent. Et ne le créez pas une fois pour toutes. La description de la marque, le positionnement produit et les informations tarifaires évoluent. Maintenez le fichier à jour avec au minimum une révision trimestrielle.
llms.txt contre robots.txt : la différence qui compte
Ces deux fichiers ont des fonctions complètement différentes, et les confondre coûte aux marques une visibilité réelle. robots.txt contrôle l'accès : il indique aux crawlers quelles pages ils sont autorisés à récupérer. Si les crawlers de récupération IA (OAI-SearchBot, PerplexityBot, ClaudeBot) sont bloqués dans votre robots.txt, ils ne peuvent pas lire votre contenu et vous ne pouvez pas être cité. C'est le fichier le plus important, et les paramètres par défaut de Cloudflare bloquent ces crawlers sur les nouveaux domaines depuis juillet 2025. Corrigez robots.txt et Cloudflare avant de vous préoccuper de llms.txt.
llms.txt contrôle la compréhension : il aide les systèmes IA à saisir ce que couvre votre site et où trouver des informations spécifiques, à condition qu'ils puissent déjà y accéder. On ne peut pas écrire un bon llms.txt sur un site où les crawlers sont bloqués : c'est une infrastructure qui repose sur l'accès, pas un substitut à celui-ci.
Ce qu'il faut prioriser à la place
Les facteurs qui déterminent les taux de citation IA en 2026, classés par impact documenté : les mentions de marque sur des sources tierces indépendantes (Reddit, G2, LinkedIn, publications sectorielles), le contenu structuré pour l'extraction avec des sections autonomes et un schéma FAQ, l'accès technique avec les crawlers IA explicitement autorisés, et la clarté d'entité via le schéma Organization avec des liens sameAs vers des profils externes. L'analyse de GrowthGPT positionne llms.txt comme une "mesure d'hygiène, pas une stratégie", plus proche d'un robots.txt propre que d'une campagne de netlinking. Pour le cadre complet, les 7 leviers GEO qui font réellement bouger les taux de citation sont le bon point de départ, et un audit GEO vous dira lequel de ces leviers est le moins développé sur votre site.
Créez le fichier llms.txt. Cela prend 30 minutes, ne coûte rien et vous positionne correctement pour un avenir où les agents IA s'appuieront effectivement dessus. Mais construisez-le après avoir couvert les fondamentaux, pas à leur place.
Questions fréquemment posées
llms.txt améliore-t-il mon classement dans ChatGPT ou Perplexity ?
Non, sur la base des données actuelles. Ahrefs a analysé 137 000 sites et constaté que 97 % des fichiers llms.txt n'ont reçu aucun trafic de bots IA en mai 2026. L'étude de SE Ranking basée sur le machine learning indique que la présence d'un llms.txt ne corrèle pas avec une fréquence de citation IA plus élevée. Aucune grande plateforme de recherche IA n'a publiquement confirmé utiliser ce fichier comme signal de citation ou de classement.
Faut-il quand même en créer un ?
Oui, si le coût est faible, ce qui est le cas pour la plupart des sites. La mise en œuvre prend moins de 30 minutes. Le fichier vous positionne correctement pour le web agentique, où des assistants de code IA comme Cursor et GitHub Copilot lisent activement les fichiers llms.txt pour naviguer dans la documentation. Les crawlers de Microsoft et d'OpenAI ont également été observés en train de récupérer ce fichier. Mettez-le en place après avoir couvert les fondamentaux GEO, pas à leur place.
Quelle est la différence entre llms.txt et robots.txt ?
robots.txt contrôle quelles pages les crawlers IA sont autorisés à accéder. Si OAI-SearchBot ou PerplexityBot sont bloqués dans votre robots.txt, ils ne peuvent pas lire votre contenu, quoi que dise votre llms.txt. llms.txt contrôle la compréhension : il aide les systèmes IA à comprendre ce que couvre votre site une fois l'accès accordé. Corrigez d'abord l'accès aux crawlers. Construisez ensuite llms.txt par-dessus.
Quel est le format correct d'un fichier llms.txt ?
Le fichier utilise le format Markdown. Il commence par un H1 contenant le nom de votre site ou de votre marque. En dessous, un bloc de citation avec une description factuelle de une à trois phrases sur ce que fait le site. Ensuite, des sections H2 regroupant les pages connexes, chacune avec des liens au format : - [Titre](URL) : description en une ligne. Les agents parsent directement cette structure : toute déviation rompt l'analyse. Restez organisé, pas exhaustif.
Quelle est la différence entre llms.txt et llms-full.txt ?
llms.txt est l'index : une carte organisée de vos pages les plus importantes avec de courtes descriptions, conçue pour une navigation rapide. llms-full.txt est la bibliothèque : l'intégralité du contenu de votre site compilé en un seul document Markdown pour une ingestion IA approfondie. La plupart des sites n'ont besoin que de llms.txt. Les produits SaaS avec une documentation dense et les plateformes développeurs avec de larges références API bénéficient de maintenir les deux fichiers en synchronisation.
Sachez ce que les moteurs IA disent réellement de votre marque
llms.txt informe les systèmes IA sur votre site. Savoir ce que ChatGPT, Perplexity et Gemini disent réellement de votre marque est un problème différent. VizibleAI surveille cela quotidiennement sur six moteurs IA, en suivant votre taux de mention, votre position de citation, votre sentiment et votre part de voix concurrentielle. Commencez votre essai gratuit de 7 jours, sans carte bancaire.




