SEO et visibilité dans les IA 6 min
llms.txt : à quoi ça sert vraiment
Le fichier llms.txt est une proposition de 2024 : un sommaire à la racine du site, qui indique à un agent IA quelles pages lire. Aucun grand moteur ne dit s'en servir pour choisir qui citer, et Google écrit qu'aucun fichier spécial n'est nécessaire pour ses fonctionnalités IA. Il sert aux agents qui lisent un site à la demande.
Ce que dit la proposition
Le fichier llms.txt est décrit sur llmstxt.org, le site de la proposition, publiée par Jeremy Howard le 3 septembre 2024 et révisée le 10 août 2026. Le texte se présente lui-même comme « une proposition pour standardiser l’usage d’un fichier /llms.txt ». Le mot compte : ce n’est pas une norme d’un organisme, c’est une convention que chacun est libre d’adopter.
Le format est volontairement simple. Un fichier Markdown à la racine du site, qui contient :
- un titre de niveau 1, seul élément obligatoire, avec le nom du site ou du projet ;
- un court résumé en citation ;
- éventuellement quelques paragraphes d’explication ;
- des sections titrées qui listent des liens, chacun avec une note facultative. Une section nommée « Optional » regroupe, par convention, ce qu’un agent peut sauter quand il manque de place.
La proposition recommande aussi de servir une version Markdown propre des pages utiles, à la même adresse avec .md ajouté. L’idée de fond est juste : une page HTML moderne est remplie de menus, de scripts et de bandeaux, et un modèle qui doit en extraire l’essentiel dans une fenêtre de contexte limitée gagne à recevoir un texte déjà nettoyé.
Le site prend soin de distinguer le fichier de ses voisins. robots.txt dit qui a le droit de lire ; sitemap.xml liste toutes les pages pour l’indexation ; llms.txt choisit ce qu’un agent devrait lire pour comprendre le site, à la demande.
Ce qu’on peut vérifier de son usage réel
C’est ici que les articles enthousiastes s’emballent. Voici ce que nous avons pu vérifier nous-mêmes, sources ouvertes.
Côté publication, l’adoption est réelle. La version 2 de la proposition affirme que des milliers de sites publient un llms.txt et que des plateformes de documentation le génèrent automatiquement. Nous n’avons pas compté ces milliers de sites, mais un exemple se vérifie facilement : la documentation d’OpenAI sur ses robots renvoie elle-même à son /llms.txt comme index de sa documentation, et propose des versions Markdown de ses pages en ajoutant .md à l’adresse.
Côté lecture par les moteurs, rien de vérifiable. Ce qu’un éditeur publie pour sa propre documentation ne dit pas ce que ses robots lisent ailleurs. Les pages officielles que nous avons ouvertes vont toutes dans le même sens :
- La même documentation d’OpenAI décrit ses robots (OAI-SearchBot pour la recherche dans ChatGPT, GPTBot pour les modèles) en parlant de robots.txt, jamais de llms.txt comme critère.
- La page d’aide d’Anthropic sur ses robots ne mentionne pas llms.txt.
- Google est le plus explicite : sa documentation sur les fonctionnalités IA indique qu’il n’est pas nécessaire de créer de nouveaux fichiers lisibles par une machine ni de fichiers texte pour l’IA pour apparaître dans les AI Overviews ou le mode IA.
La proposition elle-même reste prudente : elle écrit que le fichier devait surtout servir au moment où un modèle répond (l’inférence) plutôt qu’à l’entraînement, et elle ne prétend nulle part qu’il influence le classement ou le choix des sources citées.
Notre conclusion, en l’état de ce qui se vérifie au 2 octobre 2026 : aucune source primaire ne permet d’affirmer qu’un grand moteur se sert de llms.txt pour décider qui citer. Ceux qui le promettent extrapolent. Si un éditeur l’annonce un jour noir sur blanc, cet article sera mis à jour.
Où il sert vraiment
Le fichier a pourtant un usage concret, plus modeste que celui qu’on lui prête : les agents qui lisent un site à la demande. Un assistant de code qui doit apprendre une bibliothèque, un agent à qui l’on donne l’adresse d’un site en lui demandant de répondre à partir de son contenu, un outil interne qui interroge une documentation. Dans ces cas, quelqu’un a déjà décidé de lire votre site ; llms.txt lui évite de deviner par où commencer.
Ce que nous avons fait
Challenge Us : un sommaire et un corpus
Challenge Us est notre application de défis entre proches. Son site publie deux fichiers complémentaires, tous deux écrits au moment de la construction du site à partir des mêmes listes que les pages :
/llms.txt, le sommaire : un résumé de l’application, puis l’aide, le blog, les pages de défis et les pages légales, chacun avec son lien./aide/index.json, le corpus de la base de connaissances : pour chacune des 45 pages, la question, la réponse courte, le texte sans mise en forme, la section, l’adresse canonique, la date de vérification et la version de l’application où la réponse a été vérifiée.
Le premier dit où aller, le second dit quoi lire. Parce qu’ils sont produits par la même liste que les pages publiées, ils ne peuvent pas se désynchroniser du site : c’est la seule condition qui nous fait accepter un fichier de plus. Un llms.txt maintenu à la main finit toujours par mentir sur ce qui existe.
Nous avons aussi décidé ce que nous ne ferions pas : ni base vectorielle ni découpage pour un moteur de recherche sémantique. À quelques dizaines de pages, tout le corpus tient dans la fenêtre de contexte d’un modèle. Monter l’infrastructure avant d’avoir le contenu, c’est se retrouver avec l’infrastructure et pas le contenu.
Palmora : un manque relevé à l’audit, puis comblé
Sur Palmora, notre agence immobilière à Phuket en six langues, l’audit SEO et GEO du 22 juillet 2026 notait l’absence de llms.txt (la requête renvoyait une 404). Nous l’avions classé en priorité basse, estimé à deux ou trois heures avec un flux RSS du blog, loin derrière le vrai problème du jour : un robots.txt qui bloquait les robots IA à notre insu, que nous racontons dans l’article sur comment être cité par ChatGPT. Le fichier existe aujourd’hui, généré à chaque requête : présentation de l’agence, zones principales, guides par langue et par nationalité, portails de biens.
Et ce site ?
Honnêtement : brainplusai.com n’en a pas encore. Ce n’est pas une pose, c’est l’ordre de priorité que nous recommandons : la structure d’abord, le sommaire ensuite. Le blog et les offres sont en cours de structuration, et un sommaire publié avant que la structure soit stable serait à refaire.
Faut-il en publier un ?
Oui, si les trois conditions suivantes sont réunies, et sans rien en attendre en matière de citations :
- Le reste est en ordre. Robots IA autorisés à lire le site, pages qui répondent à une question en tête, faits sourcés, données structurées fidèles à ce qui est affiché. Un llms.txt ne compense aucun de ces manques. Nous détaillons ces fondations dans ce qu’une agence SEO doit livrer à l’heure de l’IA.
- Il est généré, pas écrit à la main. Produit au build depuis vos collections de contenu ou votre catalogue, il reste juste sans effort. Écrit à la main, il vieillit dès la deuxième page ajoutée.
- Il pointe vers des pages qui répondent. Un sommaire de pages creuses ne sert à rien. Sur un site multilingue, il pointe vers des pages qui existent dans la langue annoncée : les erreurs de hreflang relèvent du même soin.
Pour savoir s’il est lu, regardez vos journaux de serveur : qui demande /llms.txt, et à quelle fréquence. C’est la seule mesure honnête disponible aujourd’hui.
La vérification de ces fondations fait partie de notre audit SEO, et leur mise en place dans la durée de notre moteur SEO et GEO.
Questions fréquentes
llms.txt remplace-t-il robots.txt ? Non. robots.txt dit qui a le droit de lire votre site et les robots des grands acteurs le respectent. llms.txt ne bloque ni n’autorise rien : il suggère quoi lire à qui a déjà décidé de lire. Si votre robots.txt bloque les robots IA, aucun llms.txt n’y changera rien.
Faut-il aussi un llms-full.txt ? Certains sites publient une version qui contient tout le texte. C’est utile quand le corpus est petit et structuré, comme une documentation ou une base d’aide. Pour Challenge Us, nous avons préféré un JSON structuré, plus facile à exploiter par un programme qu’un long fichier texte.
Combien de temps faut-il pour en créer un ? Pour un site dont le contenu vit dans des collections ou une base, quelques heures suffisent à le générer automatiquement ; c’était notre estimation pour Palmora. Le coût réel est de le garder juste, d’où l’intérêt de le générer à chaque construction du site plutôt que de l’écrire une fois.
Jim · fondateur de Brain Plus AI
À lire aussi en seo et visibilité dans les ia
- 7min
Guide pratique
Comment être cité par ChatGPT et les moteurs IA
Ce qui fait vraiment qu'un site est cité par ChatGPT, Claude ou Perplexity : laisser lire les robots, répondre tout de suite, sourcer, baliser ce qui est affiché. Et comment le mesurer sans se raconter d'histoires.
- 6min
Choisir et chiffrerLe guide du sujet
Agence SEO IA : ce qu'elle doit vraiment livrer en 2026
« IA » est devenu l'argument de vente de toutes les agences SEO. Voici ce qu'une agence SEO IA doit concrètement livrer, les questions qui démasquent les autres, et pourquoi la relecture humaine reste non négociable.
- 7min
Guide pratique
Hreflang et SEO multilingue : les erreurs qui coûtent cher
Hreflang vers des pages qui n'existent pas, x-default mal choisi, 404 dans la mauvaise langue, titres non traduits, langue routée mais oubliée : les erreurs que nous avons trouvées sur nos propres sites multilingues, et comment les éviter.