Technique6 min de lecture
Le fichier llms.txt : à quoi il sert, comment l'écrire
Un fichier texte à la racine de votre domaine, qui résume votre site en langage clair à l'intention des modèles de langage. Aucun grand moteur ne s'est engagé à le lire. Voici pourquoi nous en posons quand même un, et ce qu'il faut y mettre.
Écrit par Thomas, avec ClaudeCofondateur de Levupp
Le fichier llms.txt est un fichier texte placé à la racine d'un domaine, à l'adresse /llms.txt, qui décrit le site en markdown à l'intention des modèles de langage : une phrase de présentation, puis une liste des pages importantes avec pour chacune un lien et une ligne de description. La proposition date de septembre 2024 et vient de Jeremy Howard. En aout 2026, aucun grand fournisseur de modèle ne s'est publiquement engagé à le lire.
Ce qu'il contient exactement
Le format tient en quelques règles, et c'est sa qualité principale.
- Un titre de niveau 1 avec le nom du site.
- Un paragraphe en italique qui résume ce qu'on y trouve.
- Des sections de niveau 2, chacune contenant une liste de liens au format markdown, avec une description après deux-points.
Rien d'autre. Pas de balisage, pas de syntaxe propriétaire, pas de fichier compagnon obligatoire. Un développeur le lit en dix secondes, un modèle aussi, et c'est précisément l'intention.
La proposition prévoit aussi un llms-full.txt, qui contient le texte intégral du site concaténé. Nous n'en posons pas. Sur un site qui porte des dizaines d'articles, ce fichier atteint plusieurs mégaoctets, il doit être régénéré à chaque publication, et personne n'a démontré qu'il servait à quoi que ce soit.
Pourquoi il existe
L'argument technique est réel. Une page web moderne est un empilement de HTML, de scripts, de navigation, de bandeaux et de pieds de page. Un modèle qui la reçoit doit en extraire le contenu utile, et il en perd une partie au passage. Un fichier markdown propre lui donne la même information sans le bruit.
L'argument est d'autant plus solide que la fenêtre de contexte d'un modèle est une ressource limitée. Faire lire à un modèle trois cents kilooctets de HTML pour en tirer deux paragraphes est un gâchis. Le fichier llms.txt est le robots.txt de la compréhension, là où l'original est celui de l'autorisation.
Pourquoi il ne suffit pas, et pourquoi il faut le dire
Voici l'état des faits, en aout 2026 : la proposition n'est pas un standard, aucun organisme ne l'a adoptée, et les principaux fournisseurs de modèles n'ont pas annoncé qu'ils la suivaient. Google a explicitement indiqué ne pas utiliser le fichier. Plusieurs analyses de journaux de serveur montrent que les crawlers d'IA le demandent rarement ou jamais.
Les agences qui présentent llms.txt comme la clé de la visibilité dans les réponses IA vendent une prestation dont l'effet n'est pas démontré. Sur un sujet où le client ne peut pas vérifier, c'est un problème.
Nous en posons un quand même, pour trois raisons qui n'ont rien de magique.
D'abord, le coût est nul quand il est engendré depuis les données du site plutôt que tenu à la main. Sur ce site, /llms.txt est fabriqué à partir du registre des pages d'expertise et de la liste des articles publiés. Il ne peut pas se désynchroniser, parce que personne ne l'écrit.
Ensuite, il ne peut pas nuire. Il n'expose rien qui ne soit déjà public, et il n'influence pas le référencement classique.
Enfin, l'exercice force une clarté utile. Écrire une ligne de description par page importante oblige à répondre à la question « à quoi sert cette page », et il arrive qu'on découvre à cette occasion qu'une page n'a pas de réponse. C'est un audit éditorial déguisé en fichier technique.
Comment l'écrire
La structure minimale ressemble à ceci.
- Une ligne de titre, avec le nom de l'entreprise.
- Un résumé d'une à trois phrases, qui doit se comprendre par quelqu'un qui n'a jamais entendu parler de vous. Mettez-y le métier, la ville, la date de création.
- Une section par famille de pages : les services, les réalisations, les articles, les pages de contact et de droit.
- Pour chaque entrée, un lien absolu et une description d'une ligne qui dit ce que la page contient, pas ce qu'elle promet.
Trois erreurs reviennent souvent.
Écrire des descriptions marketing. « La meilleure agence web de la région » n'apprend rien à un modèle et fait baisser la valeur de tout le fichier. « Agence web à Marseille, fondée en 2019, conception de sites Next.js et Shopify » est utilisable.
Y mettre tout le site. Un fichier de deux cents entrées ne hiérarchise plus rien. Prenez les vingt à quarante pages qui comptent vraiment.
L'écrire à la main. Il sera faux dans trois mois. Engendrez-le depuis vos données, comme un sitemap.
L'engendrer plutôt que le tenir
Sur une application Next.js avec App Router, une route app/llms.txt/route.ts qui rend du texte brut fait l'affaire. Elle lit les mêmes sources que le reste du site : le registre des pages de service, la liste des articles publiés, les constantes de l'entreprise.
Deux précautions valent d'être notées. La première : protégez les lectures en base. Un fichier annexe ne doit jamais faire échouer un déploiement parce que la base n'était pas joignable au moment du build. La seconde : n'y listez que ce que vous acceptez de voir indexé. Les pages en noindex n'ont rien à y faire, exactement comme dans le sitemap. Annoncer une page dans un fichier et demander par ailleurs de l'ignorer est une contradiction que les moteurs tranchent mal.
Ce qui compte davantage
Si vous n'avez du temps que pour une chose, ce n'est pas celle-là. Par ordre d'effet décroissant sur votre présence dans les réponses IA :
- Des pages dont les quatre-vingts premiers mots répondent littéralement au titre.
- Une structure de titres qui suit les questions réellement posées.
- Des chiffres datés et sourcés, vérifiables par un tiers.
- Un site rapide et réellement accessible aux robots.
- Des mentions de votre marque sur des sites que vous ne contrôlez pas.
- Un balisage
schema.orgcorrect. - Un fichier
llms.txt.
Il est septième sur sept, et c'est sa place honnête.
Questions fréquentes
llms.txt remplace-t-il robots.txt ou le sitemap ?
Non, les trois répondent à des questions différentes. Le robots.txt dit ce qu'un robot a le droit de parcourir, le sitemap.xml dit quelles adresses existent et quand elles ont changé, le llms.txt explique en langage clair ce que le site contient. Le sitemap reste le seul des trois que Google et Bing lisent officiellement.
Un llms.txt peut-il nuire à mon référencement ?
Non. Il n'est pas pris en compte par les moteurs de recherche classiques et n'entre dans aucun calcul de classement. Le seul risque, mineur, serait d'y exposer des adresses que vous ne vouliez pas rendre publiques, ce qui se règle en n'y listant que des pages déjà indexables.
Faut-il aussi produire un llms-full.txt ?
Rarement. Ce fichier contient le texte intégral du site concaténé, il pèse vite plusieurs mégaoctets et doit être régénéré à chaque publication. Aucune donnée publique ne montre qu'il soit consommé. Sur un site de taille moyenne, l'effort est mieux placé ailleurs.
Comment vérifier que le mien est correct ?
Ouvrez-le dans un navigateur : il doit s'afficher en texte brut, pas se télécharger. Vérifiez que le type de contenu est text/plain, que tous les liens sont absolus et fonctionnent, et qu'aucune page en noindex n'y figure. Puis relisez les descriptions en vous demandant si un inconnu comprendrait à quoi sert chaque page.
En pratique
Posez-en un, ne payez pas pour ça, et n'en attendez rien de spectaculaire. Le travail qui produit réellement des citations est celui décrit dans notre article sur l'écriture des pages citables, et il faut d'abord savoir où vous en êtes, ce que permet la méthode de test en vingt minutes. Le fichier de ce site est visible à l'adresse /llms.txt, engendré à chaque requête depuis les mêmes données que le sitemap.
À lire ensuiteTous les articles
On construit le vôtre ?
Racontez-nous ce que vous avez en tête,on vous dit ce qu'on en ferait.
Démarrer un projet




