Blog · Pour les professionnels
llms.txt : qu'est-ce que c'est, et sert-il vraiment ?
Si vous avez lu quelque part que votre site « doit avoir » un fichier llms.txt, la bonne question n'est pas comment l'écrire. C'est s'il sert à quelque chose. Cette page répond aux deux, et à la seconde elle répond de façon inconfortable.
llms.txt est une proposition de standard : un fichier texte placé à la racine du site, comme le robots.txt, qui indique aux modèles d'intelligence artificielle quels contenus comptent et où les trouver. La spécification se trouve sur llmstxt.org et est ouverte depuis peu.
Ce que c'est, et pourquoi ce n'est pas le robots.txt
Le robots.txt et llms.txt répondent à deux questions différentes, et les confondre est l'erreur la plus courante. Le robots.txt indique ce qu'on peut lire : c'est une autorisation, et qui l'ignore viole une convention. llms.txt indique ce qui vaut la peine d'être lu : c'est une suggestion, et personne n'est obligé de la suivre.
La forme est différente en conséquence. Le robots.txt est une liste de règles pour les crawlers. llms.txt est écrit en Markdown : le nom de l'activité, une description en une ligne, et une liste de liens vers les pages qui comptent, chacun avec une phrase expliquant ce qu'on y trouve. Il est pensé pour être lu par une machine qui a peu d'espace et doit comprendre rapidement.
Sur 88 sites italiens mesurés, 68 n'en ont pas
Le chiffre vient de nos mesures, pas d'une estimation : nous avons analysé avec notre moteur 88 sites italiens de cinq catégories, dont des cabinets d'avocats, des restaurants, des kinésithérapeutes, des agences immobilières et des instituts de beauté. Parmi eux, 68 n'exposent aucun llms.txt.
Pour les vingt autres, nous ne pouvons pas affirmer avec certitude qu'ils en ont un : le contrôle peut ne pas avoir abouti, par exemple si le site a mal répondu à ce moment-là. Le chiffre honnête est donc celui-ci : au moins 77 % des sites mesurés n'ont pas de llms.txt. La part réelle est probablement plus élevée.
Ce qu'il promet, et ce que personne n'a encore prouvé
Voici ce que presque aucun article sur le sujet ne dit. Il n'existe aucune documentation officielle d'OpenAI, Google ou Anthropic confirmant qu'ils lisent llms.txt, ni d'études publiques mesurant son effet sur les citations. C'est une proposition de la communauté, pas un standard adopté par les moteurs.
Cela ne veut pas dire que c'est inutile, cela veut dire que quiconque vous promet un résultat promet quelque chose qu'il ne peut pas savoir. Le bénéfice plausible est un bénéfice d'orientation : si un modèle lit le fichier, il trouve une carte propre du site au lieu de devoir la déduire du HTML. Le bénéfice prouvé, aujourd'hui, est nul.
Comment l'écrire, en pratique
Un llms.txt minimal comporte un titre avec le nom de l'activité, un paragraphe expliquant ce que vous faites et où, et une section de liens vers les pages principales, chacun avec une ligne d'explication. Les liens doivent être des adresses réelles et accessibles : un fichier qui renvoie vers des pages qui n'existent pas est pire que pas de fichier du tout.
Il s'enregistre sous le nom llms.txt et se place à la racine, c'est-à-dire à l'adresse votresite.fr/llms.txt. Pas besoin de le déclarer où que ce soit, comme le robots.txt il se trouve parce qu'il est là.
Un exemple réel, le nôtre
Les guides sur ce sujet montrent presque toujours un exemple inventé. Voici le fichier que nous servons réellement sur trovavio.com/llms.txt, raccourci uniquement dans les dernières lignes :
# Trovavio
> Audit SEO et GEO pour professionnels et agences italiennes : analysez votre site
> en 30 secondes et découvrez s'il est visible sur Google et sur les moteurs IA comme ChatGPT.
Trovavio est un outil d'analyse en ligne pensé pour les professionnels et les agences
en Italie. En quelques secondes, il génère un audit complet de votre site web, expliqué
en italien simple et adapté à votre secteur.
## Pages principales
- [Trovavio, Audit SEO et GEO](https://trovavio.com/) : l'outil d'analyse,
tarifs et questions fréquentes
- [Blog : guides sur le SEO et le GEO](https://trovavio.com/blog) : comment se faire trouver sur
Google et être cité par les assistants IA
Trois choses à noter. Le titre est le nom de l'activité, pas un slogan. La ligne qui commence par le signe supérieur est la description en une phrase, et c'est la partie qu'un modèle lit en premier. Chaque lien a une explication après les deux points, car une liste d'adresses nues ne dit à personne laquelle ouvrir.
Ce qu'il ne faut pas y mettre
Ce n'est pas un endroit pour les mots-clés. Le remplir de phrases répétées en espérant qu'un modèle les pèse est la version 2026 du texte blanc sur fond blanc : il n'a jamais été prouvé que ça fonctionne, et c'est exactement le genre de chose que les moteurs apprennent à ignorer en premier.
Et n'y mettez pas de pages que vous ne voulez pas faire lire. Un fichier qui liste l'espace réservé ou une page en brouillon la signale, il ne la cache pas : pour cela, il faut le robots.txt, qui est l'autre fichier et fait l'autre travail.
Est-ce que ça vaut le coup ? La réponse honnête
Cela vaut le coup si vous le considérez pour ce que c'est : une demi-heure de travail, une fois, sur un pari à faible coût. Cela ne vaut pas le coup si quelqu'un vous le vend comme la raison pour laquelle vous n'apparaissez pas sur ChatGPT, car cette raison, dans les sites que nous avons mesurés, en est presque toujours une autre : des contenus qui ne répondent à aucune question, aucune donnée structurée, ou les robots des IA bloqués par le robots.txt sans que le propriétaire le sache.
Dit autrement : llms.txt est la dernière des étapes, pas la première. Si votre site a des problèmes plus importants, ce fichier ne les compense pas.