Points clés de l'article
- llms.txt est un fichier markdown à la racine du site qui décrit sa structure en langage naturel, à destination des modèles de langage
- Aucun grand modèle n'a annoncé officiellement le lire. Ce n'est pas une raison suffisante pour ne pas en faire un, et ce n'est pas une raison suffisante pour en attendre des miracles
- Il ne bloque rien et ne force personne à vous citer. Pour interdire l'accès, c'est robots.txt. Pour lister vos URL, c'est sitemap.xml
- Sa vraie valeur est ailleurs : écrire un llms.txt oblige à formuler en trois phrases ce que fait votre entreprise. Beaucoup d'équipes découvrent à ce moment qu'elles n'en sont pas capables
- 7 sites sur 31 du secteur en ont un d'exploitable, et 2 agences SEO françaises sur 15. Le coût est de deux heures, le risque est nul, le bénéfice est incertain mais asymétrique
llms.txt a été proposé en septembre 2024 par Jeremy Howard. Depuis, deux camps se sont formés. D'un côté ceux qui l'installent partout et le présentent comme le nouveau sitemap de l'ère IA. De l'autre ceux qui haussent les épaules en rappelant qu'aucun grand modèle n'a annoncé le lire.
Les deux se trompent, mais pas là où ils le croient.
Vydera a un llms.txt en ligne sur vydera.com. Cet article dit ce qu'il fait, ce qu'il ne fait pas, comment il est construit, et ce que 31 sites du secteur font réellement du leur.
llms.txt en une phrase
C'est un fichier markdown placé à la racine d'un site, qui décrit en langage naturel ce que contient ce site et à quoi sert chaque groupe de pages.
Rien de plus. Pas de balisage, pas de schéma, pas de directive technique. Du texte structuré, lisible par un humain comme par une machine.
L'idée de départ est simple : une page web moderne est un mauvais support de lecture pour un modèle. Entre la navigation, les scripts, les bandeaux de consentement et les composants d'interface, le contenu utile représente souvent moins de 10 % du HTML servi. llms.txt propose un raccourci : voici la carte, voici où aller, voici pourquoi.
Trois choses que llms.txt ne fait pas
1. Il ne bloque rien
C'est la confusion la plus fréquente. llms.txt n'a aucune valeur d'interdiction. Un crawler qui le lit n'est pas obligé de le respecter, et un crawler qui l'ignore n'enfreint aucune règle.
Pour contrôler l'accès, le fichier à éditer est robots.txt, avec les user-agents des crawlers IA. C'est un chantier différent, que l'on traite ailleurs.
2. Il ne force personne à vous citer
Un llms.txt bien écrit n'améliore pas mécaniquement votre taux de citation. Il rend votre contenu plus facile à comprendre pour un modèle qui a déjà décidé d'aller le chercher. La décision d'aller le chercher, elle, se joue en amont : autorité de la marque, densité de mentions, qualité des sources qui parlent de vous.
Ce mécanisme est détaillé dans notre article sur le fonctionnement des réponses des IA génératives.
3. Ce n'est pas un sitemap
Un sitemap liste des URL. Un llms.txt explique à quoi elles servent. La différence est la description après chaque lien : c'est elle qui porte toute la valeur, et c'est précisément elle que la plupart des llms.txt générés automatiquement omettent.
| Fichier | Ce qu'il fait | Qui le respecte | Bloque l'accès |
|---|---|---|---|
| robots.txt | Autorise ou refuse le crawl, user-agent par user-agent | Tous les crawlers sérieux | Oui |
| sitemap.xml | Liste exhaustive des URL, avec leur date de modification | Google, Bing | Non |
| llms.txt | Explique la structure du site et le role de chaque groupe de pages, en langage naturel | Aucune adoption officielle annoncee | Non |
Anatomie d'un llms.txt qui sert à quelque chose
Voici le fichier de vydera.com, zone par zone. Cliquez sur une zone pour voir la règle qui s'y applique et l'erreur la plus fréquente associée.
Anatomie du llms.txt de vydera.com
Cliquez une zone du fichier pour voir la règle qui s'y applique.
Fichier réel, relevé le 27 août 2026 sur https://vydera.com/llms.txt
On a mesuré 31 sites du secteur. 7 ont un llms.txt exploitable.
Tout le monde en parle, très peu en font un. Le 27 août 2026, on a testé /llms.txt sur 31 domaines : 15 agences SEO françaises, 15 outils SEO et GEO, plus vydera.com. Voici le résultat brut.
7 sites sur 31 servent un fichier exploitable. Les 24 autres renvoient un 404, un 403, ou une page HTML. Chez les agences SEO françaises, le score tombe à 2 sur 15 : noiise.com et uplix.fr. Eskimoz, Primelis, Resoneo, Semji, Keyweo, Digimood, 1ère Position, Slashr, Korleon, Natural Net, Open Linking, seo.fr : rien.
Côté outils, le contraste est plus surprenant encore. Ahrefs, Botify, OnCrawl, Screaming Frog, Babbar, Haloscan, MyPoseo n'en ont pas. Et parmi les outils qui vendent précisément de la visibilité IA, Peec AI, Profound, Nightwatch et Authoritas non plus. Seuls Otterly et Scrunch en servent un.
| Domaine | Type | Liens | Avec description | Vers du markdown |
|---|---|---|---|---|
| similarweb.com | Outil | 111 | 111 | 93 |
| scrunchai.com | Outil GEO | 95 | 2 | 0 |
| vydera.com | Agence FR | 81 | 43 | 81 |
| otterly.ai | Outil GEO | 49 | 12 | 0 |
| semrush.com | Outil | 42 | 42 | 0 |
| uplix.fr | Agence FR | 31 | 31 | 0 |
| noiise.com | Agence FR | 0 | 0 | 0 |
Le tableau dit deux choses.
Avoir un fichier ne veut pas dire avoir un bon fichier. noiise.com sert 5 669 octets, 10 sections H2, et zéro lien au format markdown : le fichier existe et ne mène nulle part. Scrunch aligne 95 liens dont 2 seulement portent une description : c'est le sitemap déguisé, l'erreur exacte décrite plus haut. Otterly fait 12 sur 49.
Les fichiers les plus soignés viennent des outils, pas des agences. Similarweb sert 111 liens, tous décrits, dont 93 pointant vers des variantes markdown. Semrush : 42 liens, 42 descriptions. uplix.fr, la seule agence française à faire un fichier propre : 31 sur 31.
Et Vydera dans tout ça ? 81 liens, 43 descriptions. 38 liens nus, soit presque la moitié du fichier. C'est mieux que la moyenne du secteur et ce n'est pas propre. La correction est dans notre backlog, et le fait de le publier vaut mieux que de prétendre le contraire.
Les variantes markdown, elles, existent vraiment
Une chose est vérifiable sans accès aux logs de personne : ce que le serveur répond. Le llms.txt de Vydera pointe vers 81 URL en /index.md. Elles répondent toutes en 200, avec un Content-Type: text/markdown et du markdown propre.
Sur les 7 fichiers exploitables du panel, 2 seulement font ça : Similarweb (93 liens en .md) et Vydera (81). Les cinq autres renvoient vers des pages HTML classiques.
C'est là que se joue l'essentiel du travail. Un lien vers une page HTML chargée de navigation, de scripts et de bandeaux impose au modèle de trier. Un lien vers du markdown lui sert le contenu directement. Le fichier est le point d'entrée, les variantes markdown sont le produit. Faire l'un sans l'autre, c'est faire la moitié du chemin.
Faut-il en faire un ? La réponse honnête
Oui, et pour une raison qui n'a rien à voir avec les moteurs IA.
Écrire un llms.txt correct impose trois exercices que la plupart des équipes n'ont jamais faits :
- Résumer l'entreprise en trois phrases, sans adjectif promotionnel, en disant ce qu'elle fait, pour qui, et avec quel résultat mesurable. C'est le blockquote. Beaucoup d'équipes découvrent à ce moment qu'elles n'ont pas de réponse nette.
- Classer les pages par rôle, pas par emplacement dans le menu. Ce qui informe, ce qui vend, ce qui prouve, ce qui n'est là que pour des raisons légales.
- Écrire une description utile pour chaque page. Pas le titre recopié : une phrase qui dit ce qu'on y trouve et pourquoi on irait la lire.
Ces trois exercices améliorent le site, la copy et le maillage, que les moteurs IA lisent le fichier ou non.
Le calcul est simple : deux heures de travail, zéro risque technique, un bénéfice incertain côté moteurs mais certain côté clarté. C'est un pari asymétrique, et il faut le prendre.
Les cinq erreurs qu'on voit le plus
- Le fichier généré automatiquement. Un plugin qui recopie le sitemap en markdown produit un fichier sans descriptions, donc sans valeur. Le llms.txt s'écrit à la main.
- Le blockquote publicitaire. « Leader de l'accompagnement digital » ne dit rien à un modèle. « Agence SEO et GEO, clients B2B en France, résultats mesurés à 90 jours » dit quelque chose.
- Les URL relatives. Le fichier peut être récupéré hors contexte. Toujours des URL absolues.
- Le fichier de 400 lignes. Un llms.txt n'est pas exhaustif. Il est sélectif. Si vous listez tout, vous ne priorisez rien.
- Le fichier écrit une fois et oublié. Un llms.txt qui pointe vers des pages supprimées est pire que pas de fichier du tout. À relire à chaque refonte, comme le sitemap.
Et après
llms.txt est une brique, pas une stratégie. Il prend son sens dans un ensemble : des données structurées propres, un contenu écrit pour être cité, et une architecture que les moteurs traversent sans se perdre.
Si vous ne savez pas par où commencer, la question à se poser n'est pas « est-ce que j'ai un llms.txt ». C'est : est-ce qu'un modèle qui arrive sur mon site comprend en trente secondes ce que je fais et pour qui. Si la réponse est non, le fichier n'y changera rien.
Pour le cadre général de ce qui se joue sur les moteurs IA, notre article GEO / AEO : définition complète pose les bases. Et si le sujet est l'architecture du site, c'est un chantier à part entière.
llms.txt est-il obligatoire pour être visible dans les IA ?
Non. Aucun grand modèle n'a annoncé officiellement lire ce fichier, et une marque peut être largement citée sans en avoir un. llms.txt facilite la compréhension de votre site par un modèle qui a déjà décidé d'aller le lire, il ne déclenche pas cette décision.
Quelle différence entre llms.txt et robots.txt ?
robots.txt autorise ou refuse le crawl, llms.txt explique la structure du site. robots.txt est respecté par tous les crawlers sérieux et bloque effectivement l'accès. llms.txt n'a aucune valeur d'interdiction : c'est un document d'aide à la lecture, pas une directive.
Où placer le fichier llms.txt ?
À la racine du domaine, accessible en
https://votresite.com/llms.txt, servi entext/plainoutext/markdown. Même emplacement logique que robots.txt et sitemap.xml.Faut-il aussi créer des versions markdown de ses pages ?
C'est ce qui distingue les fichiers sérieux des autres. Sur les 31 domaines du secteur que nous avons testés le 27 août 2026, 7 servent un llms.txt exploitable, et 2 seulement pointent vers des variantes markdown : Similarweb et Vydera. Servir un markdown propre évite au modèle de traverser du HTML chargé de navigation et de scripts.
Combien de temps prend la rédaction d'un llms.txt ?
Environ deux heures pour un site de taille moyenne, si le fichier est écrit à la main. Un fichier généré automatiquement depuis le sitemap se produit en une minute et ne sert à rien, parce qu'il n'a pas de descriptions.
Un llms.txt peut-il nuire au SEO classique ?
Non. Le fichier n'est pas indexable comme une page de contenu, il n'entre en concurrence avec rien et ne modifie aucun signal Google. Le seul risque est de laisser en ligne un fichier qui pointe vers des pages supprimées, ce qui envoie un mauvais signal de fraîcheur.



.jpg)
