llms.txt : à quoi ça sert et comment le créer, étape par étape
Mis à jour le 20 août 2026Par l'équipe GND Consulting, studio créatif humain × IA
SEO & GEO8 min de lecture

llms.txt : à quoi ça sert et comment le créer, étape par étape

llms.txt est un fichier Markdown déposé à la racine d'un site, censé donner aux modèles de langage une carte propre de son contenu. La convention est simple à mettre en oeuvre et son effet réel sur votre visibilité est, à ce jour, très faible. Ce guide donne la syntaxe exacte, un exemple complet, et les données publiques sur son adoption réelle.

D'où vient la convention

La proposition a été publiée en septembre 2024 par Jeremy Howard et l'équipe d'Answer.AI. Le constat de départ est technique : les fenêtres de contexte des modèles sont trop petites pour avaler un site entier, et une page HTML moderne est noyée sous la navigation, les scripts et les encarts. L'idée est de fournir un point d'entrée unique, en Markdown, qui décrit le site et pointe vers ses pages importantes.

Un point de vocabulaire important : ce n'est pas un standard. Il n'y a ni RFC, ni recommandation W3C, ni comité. C'est une proposition portée par un acteur privé, que la communauté a reprise. Toute personne qui vous parle du « standard llms.txt » se trompe ou vous vend quelque chose.

Ce que llms.txt n'est pas

Trois fichiers cohabitent à la racine d'un site et servent trois fonctions complètement différentes. Les confondre est l'erreur la plus commune.

FichierFonctionFormatLu par
robots.txtAutoriser ou interdire l'accès aux robotsDirectives texteTous les crawlers sérieux
sitemap.xmlLister toutes les URL indexablesXMLMoteurs de recherche
llms.txtRésumer le site et pointer les pages clésMarkdownQuelques agents, voir plus bas
robots.txt contrôle, sitemap.xml énumère, llms.txt explique.

Conséquence directe : llms.txt ne bloque rien. Il n'a aucun pouvoir d'exclusion. Si vous voulez interdire l'entraînement sur votre contenu, cela se fait dans robots.txt, avec les user-agents concernés (GPTBot, ClaudeBot, Google-Extended, entre autres). Et llms.txt ne remplace pas le sitemap : il n'est pas exhaustif, il est éditorialisé.

La syntaxe exacte

Le fichier est du Markdown, servi sous l'extension .txt. La proposition définit une structure stricte, dont un seul élément est obligatoire.

  • Un titre H1, avec le nom du site ou du projet. C'est le seul élément requis par la proposition.
  • Un blockquote juste après le H1, contenant un résumé court du site. Optionnel dans la spécification, indispensable en pratique : c'est la phrase qu'un agent lira en premier.
  • Un ou plusieurs paragraphes de contexte, sans titre, pour préciser le périmètre, la zone géographique, le public visé.
  • Des sections H2, chacune contenant une liste de liens. Le format attendu pour chaque ligne est un tiret, le titre entre crochets, l'URL entre parenthèses, puis deux points et une description courte.
  • Une section H2 nommée Optional, réservée aux ressources secondaires. C'est la seule section à valeur sémantique particulière : un agent contraint par son contexte est censé la sauter en premier.

La description après les deux points n'est pas décorative. C'est elle qui permet à un agent de décider s'il vaut la peine d'aller chercher la page. Une ligne sans description n'apporte rien de plus qu'un sitemap.

Un exemple complet, ligne par ligne

Voici un fichier utilisable tel quel, pour une agence web fictive. Chaque ligne est expliquée dans le tableau qui suit.

Contenu du fichierRôle de la ligne
# Atelier VerrierTitre H1 obligatoire : le nom exact de la marque
Ligne vide de séparation
> Agence web à Bordeaux. Sites vitrines, e-commerce et refonte SEO pour PME et artisans en Nouvelle-Aquitaine.Blockquote de résumé : la phrase que l'agent lit en premier
Ligne vide
Fondée en 2019. Équipe de six personnes. Interventions en français uniquement. Devis sous 48 heures.Paragraphe de contexte : périmètre, langue, engagement vérifiable
Ligne vide
## ServicesSection H2 : regroupe les pages commerciales
- [Sites vitrines](https://exemple.fr/services/sites-vitrines): Site de 5 à 10 pages, rendu serveur, livré en 3 semaines.Lien + description courte et factuelle
- [Refonte SEO](https://exemple.fr/services/refonte-seo): Audit technique, reprise des contenus, migration des URL.Un service par ligne, jamais de phrase creuse
Ligne vide
## GuidesDeuxième section H2 : le contenu qui fait autorité
- [Choisir un CMS](https://exemple.fr/guides/choisir-un-cms.md): Comparatif WordPress, Webflow et développement sur mesure.Pointer une version .md quand elle existe
Ligne vide
## InformationsSection H2 pour les données de contact et légales
- [Contact](https://exemple.fr/contact): Formulaire, téléphone et adresse de l'agence.Les pages que les agents cherchent le plus
Ligne vide
## OptionalSection spéciale : ignorée en priorité si le contexte est limité
- [Mentions légales](https://exemple.fr/mentions-legales): Éditeur, hébergeur, RGPD.Ressources secondaires uniquement
Fichier llms.txt complet. Les lignes vides font partie de la structure Markdown.

Trente à cinquante liens est un maximum raisonnable. Un llms.txt qui recopie l'intégralité du sitemap perd sa raison d'être : il redevient une liste, alors que son intérêt était d'être un tri.

Où placer le fichier

  • À la racine du domaine, à l'adresse https://votredomaine.fr/llms.txt. Pas dans un sous-dossier.
  • Un fichier par domaine et par sous-domaine. Un blog sur un sous-domaine a besoin du sien.
  • Servi en code 200, sans redirection intermédiaire.
  • Content-Type en text/plain ou text/markdown. Beaucoup d'hébergeurs renvoient text/html par défaut sur un .txt mal configuré.
  • En clair, jamais derrière une authentification ou un mur de protection anti-bot.

Qui le lit vraiment aujourd'hui

C'est la partie que les guides commerciaux évitent. Les données publiques disponibles en 2026 sont sans ambiguïté.

  • Google ne l'utilise pas. Le guide d'optimisation pour l'IA publié par Google Search le 15 mai 2026 indique que llms.txt n'est pas utilisé par ses systèmes de Recherche, et qu'il n'a aucun effet sur les Aperçus IA ni sur le Mode IA, qui puisent dans l'index de Recherche classique.
  • Aucun grand fournisseur ne s'est engagé publiquement à le lire dans ses systèmes de production : ni OpenAI, ni Anthropic, ni Google, ni Meta, ni Mistral.
  • Les logs le confirment. Un suivi portant sur plus de 500 millions de visites de robots IA sur 90 jours ne relève que 408 requêtes ciblant directement llms.txt. GPTBot, ClaudeBot et PerplexityBot demandent massivement des pages HTML.
  • L'adoption reste minoritaire. Une étude SE Ranking sur 300 000 domaines mesure un taux d'adoption de 10,13 %, soit environ un site sur dix.
  • Là où ça fonctionne réellement : les agents de développement. Cursor, Claude Code, GitHub Copilot et Windsurf vont chercher le llms.txt d'une documentation technique pour se repérer. C'est le seul usage massivement constaté.

llms-full.txt, la variante

Une convention voisine circule : llms-full.txt, qui concatène le contenu intégral de toutes les pages listées dans un seul fichier. L'agent récupère tout le site en une seule requête, sans avoir à suivre les liens.

C'est pertinent pour une documentation de quelques dizaines de pages. Cela devient ingérable au-delà : le fichier atteint plusieurs mégaoctets, dépasse la fenêtre de contexte qu'il était censé économiser, et se désynchronise du site à la première mise à jour oubliée. Pour un site d'entreprise classique, llms-full.txt n'a pas d'intérêt.

Comment tester votre fichier

  • Ouvrez l'URL dans un navigateur en navigation privée. Vous devez voir du texte brut, pas une page mise en forme.
  • Vérifiez l'en-tête de réponse : code 200, et un Content-Type en text/plain ou text/markdown.
  • Collez le contenu dans un éditeur Markdown. Un seul H1, des H2 bien reconnus, des listes bien formées.
  • Testez chaque URL listée une par une. Un lien mort dans un llms.txt discrédite tout le fichier.
  • Si vous pointez des fichiers .md, vérifiez qu'ils existent et ne renvoient pas une page HTML.
  • Donnez l'URL du fichier à un assistant et demandez-lui de résumer ce que fait l'entreprise. Si le résumé est faux ou vague, votre fichier est mal rédigé, pas l'assistant.
  • Surveillez vos logs serveur sur trois mois et comptez les requêtes réelles sur /llms.txt. C'est la seule mesure qui vaut pour votre site.

Les erreurs fréquentes

  • Servir du HTML. Un llms.txt généré par un plugin qui l'enveloppe dans un gabarit de page est inutilisable.
  • Le 404 silencieux. Sur une application monopage, le routeur intercepte l'URL et renvoie l'application au lieu du fichier. Vérifiez toujours en dehors du navigateur.
  • Pointer des pages vides pour les robots. Le fichier peut être parfait et les pages qu'il liste ne rien renvoyer. En août 2026, sur ce site, Perplexity-User et Google-Extended recevaient une coquille vide de 8 214 octets là où Googlebot recevait 61 549 octets. Un llms.txt impeccable n'aurait rien changé.
  • Croire que le fichier bloque quelque chose. Il n'a aucun pouvoir d'interdiction. C'est robots.txt qui autorise ou refuse.
  • Recopier le sitemap. Deux cents liens sans description, c'est un llms.txt sans valeur.
  • Omettre les descriptions. Sans elles, l'agent n'a aucun critère de sélection.
  • Ne jamais le mettre à jour. Un fichier qui décrit une offre abandonnée est pire que pas de fichier.
  • En attendre un effet SEO. Il n'y en a pas, Google l'a écrit noir sur blanc.

Faut-il en créer un : la décision en trois cas

La réponse dépend entièrement de qui consomme votre contenu. Trois situations couvrent la quasi-totalité des cas.

  • Vous éditez une documentation technique ou un produit destiné aux développeurs. Faites-le, et soignez-le. C'est le seul contexte où les requêtes sur /llms.txt sont réellement observées dans les logs, parce que les agents de code vont le chercher pour se repérer avant d'écrire une intégration. Dans ce cas, publiez aussi une version .md de chaque page importante et pointez-la depuis le fichier.
  • Vous êtes une PME, un commerce, une agence ou un cabinet. Faites-le une fois, proprement, en une heure, puis oubliez-le et passez au reste. Le coût est faible, le bénéfice est incertain, et il n'y a aucune raison d'en faire un chantier. Le risque réel est ailleurs : passer une journée sur ce fichier pendant que vos pages renvoient une coquille vide aux robots.
  • Un prestataire vous le facture comme un levier de visibilité IA.Demandez-lui de vous montrer, dans vos logs serveur, les requêtes sur /llms.txt et les citations qui en découlent. La réponse à cette question vous dira tout ce qu'il faut savoir sur la prestation.

Une remarque sur les versions Markdown des pages. La proposition d'origine suppose que vos pages existent aussi en .md, accessibles en ajoutant l'extension à l'URL. C'est une pratique courante dans l'écosystème de la documentation logicielle, quasi inexistante ailleurs. Si vous ne servez pas de .md, pointez simplement vos URL HTML : le fichier reste valide, il suppose juste que le robot sait lire une page. Ce qui nous ramène à la seule question qui compte vraiment, celle de savoir ce que vos pages renvoient réellement quand un robot IA les demande.

Que faire à la place, ou en plus

Le temps investi rapporte davantage sur trois chantiers : servir un HTML complet à tous les robots, réécrire vos pages clés en passages autonomes, et faire exister votre marque ailleurs que sur votre site. Ces trois leviers sont détaillés dans notre guide sur le GEO et dans celui consacré à la citation par ChatGPT.

Nous produisons le llms.txt en même temps que le reste du socle technique sur nos sites vitrines, sans le facturer comme une prestation à part. Si vous voulez faire vérifier ce que vos robots reçoivent réellement, écrivez-nous via la page contact.

Questions fréquentes

Toutes les réponses.

Une question qui ne figure pas ici ? Écrivez-nous, réponse sous 24h.

llms.txt améliore-t-il mon référencement Google ?
Non. Le guide d'optimisation pour l'IA publié par Google Search le 15 mai 2026 indique que llms.txt n'est pas utilisé par ses systèmes de Recherche et qu'il n'a aucun effet sur les Aperçus IA ni sur le Mode IA. Ces surfaces s'appuient sur l'index de Recherche classique.
Quelle est la différence entre llms.txt et robots.txt ?
robots.txt autorise ou interdit l'accès des robots à des zones du site : c'est un fichier de contrôle. llms.txt décrit le site et pointe vers ses pages importantes en Markdown : c'est un fichier d'orientation, sans aucun pouvoir de blocage. Pour interdire l'entraînement sur votre contenu, il faut passer par robots.txt.
Quel est le seul élément obligatoire dans un llms.txt ?
Le titre H1 avec le nom du site. Tout le reste, le blockquote de résumé, les paragraphes de contexte et les sections H2 de liens, est optionnel dans la proposition. En pratique, un fichier sans résumé ni descriptions de liens n'apporte rien à un agent.
Les IA lisent-elles vraiment llms.txt aujourd'hui ?
Très peu. Un suivi portant sur plus de 500 millions de visites de robots IA sur 90 jours ne relève que 408 requêtes ciblant llms.txt. GPTBot, ClaudeBot et PerplexityBot demandent massivement du HTML. Le seul usage réellement constaté concerne les agents de développement comme Cursor, Claude Code ou Copilot sur des documentations techniques.
Faut-il aussi créer un llms-full.txt ?
Seulement pour une documentation de taille limitée. llms-full.txt concatène le contenu intégral des pages listées. Au-delà de quelques dizaines de pages, le fichier devient trop lourd pour la fenêtre de contexte qu'il devait économiser et se désynchronise du site. Pour un site d'entreprise classique, il n'a pas d'intérêt.
Où doit être placé le fichier llms.txt ?
À la racine du domaine, à l'adresse votredomaine.fr/llms.txt, servi en code 200 sans redirection, avec un Content-Type en text/plain ou text/markdown. Il faut un fichier distinct par domaine et par sous-domaine.
contactez-nous

Votre siteà lancer ?

Studio créatif hybride. Réponse sous 24h, devis sous 48h, sans engagement.