En bref. llms.txt est un fichier texte au format Markdown, servi à l'adresse /llms.txt d'un site, qui présente l'essentiel du site et liste ses pages les plus utiles pour les assistants et agents IA. Proposé en septembre 2024 par Jeremy Howard (Answer.AI), c'est une proposition ouverte, pas un standard officiel. Google indique que sa recherche ne l'utilise pas : le fichier sert aux agents qui le consultent, pas au classement.
llms.txt revient sans cesse dans les checklists GEO, présenté tantôt comme un « robots.txt pour les IA », tantôt comme un raccourci pour être cité. Aucune de ces descriptions n'est exacte. Ce guide repart des sources primaires (la spécification, la documentation de Google, les pages officielles d'OpenAI, d'Anthropic et de Perplexity) pour expliquer le format, ce qui le distingue de robots.txt et de sitemap.xml, ce que l'on sait de sa lecture par les IA et comment le générer dans un site Next.js. Pour le cadre général, voyez notre guide du GEO (référencement dans les IA), un terme formalisé en 2023 dans un article de recherche d'Aggarwal et al.
D'où vient llms.txt ?
Jeremy Howard a proposé le fichier le 3 septembre 2024, sur le site llmstxt.org et, le même jour, sur le blog d'Answer.AI. Le constat : une page web est conçue pour des humains. Son information est noyée dans la navigation et les scripts, et les fenêtres de contexte des modèles, bien que plus grandes qu'avant, restent trop petites pour absorber la plupart des sites en entier. D'où l'idée d'un fichier court, lisible par un humain comme par un modèle, qui donne le contexte essentiel et renvoie vers des contenus détaillés. L'auteur le destine surtout à l'inférence, quand un agent cherche une information pour aider un utilisateur, plutôt qu'à l'entraînement des modèles.
La version 2, publiée en août 2026, tire les leçons de deux ans d'usage :
- un fichier peut couvrir un sous-dossier (
/docs/llms.txt) ; le plus spécifique s'applique ; - deux relations de lien,
rel="alternate" type="text/markdown"etrel="describedby", permettent aux agents de trouver la version Markdown d'une page et le llms.txt qui la couvre, via une balise<link>ou un en-tête HTTPLink; - la section « Optional » devient une simple convention, sans effet mécanique.
Le texte reste une proposition ouverte aux contributions, ni norme de l'IETF ni recommandation du W3C.
Le format exact d'un fichier llms.txt
La spécification impose un ordre précis, entièrement en Markdown :
- Un titre H1 avec le nom du site. C'est la seule section obligatoire.
- Une citation (blockquote) qui résume le site et donne les informations nécessaires pour comprendre la suite.
- Des paragraphes ou des listes, sans titres, pour les précisions utiles.
- Des sections H2, chacune formée d'une liste de liens au format
[nom](url), éventuellement suivis de deux-points et d'une note. - Par convention, une section « Optional » pour les liens secondaires, qu'un agent peut ignorer s'il manque de place.
# Nom du site
> Résumé en une ou deux phrases : qui vous êtes, ce que vous faites, pour qui.
Précisions utiles, en paragraphes ou en listes, sans titres.
## Nom de la section
- [Titre de la page](https://www.example.com/page): ce que l'agent y trouvera
## Optional
- [Page secondaire](https://www.example.com/autre-page)Les versions .md des pages
La proposition suggère aussi de publier, pour chaque page utile, une version Markdown propre à la même adresse, soit en ajoutant .md (page.html.md), soit en remplaçant l'extension par .md (page.md), et d'y faire pointer les liens de llms.txt. Les documentations techniques le font largement ; Next.js, par exemple, publie son index à l'adresse /docs/llms.txt. Pour un site d'entreprise, ce n'est pas un prérequis : des pages HTML bien structurées et rendues côté serveur restent parfaitement lisibles.
Et llms-full.txt ?
llms-full.txt ne figure pas dans la spécification. C'est une convention popularisée par les plateformes de documentation : Mintlify en génère un qui rassemble toute une documentation dans un seul fichier, chaque page avec son titre, son adresse et son contenu complet en Markdown, et la documentation développeurs d'Anthropic en publie un également. Pour résumer, llms.txt est un sommaire, llms-full.txt un dossier complet, qui n'a de sens que s'il reste de taille raisonnable et qu'il est généré automatiquement.
llms.txt, robots.txt et sitemap.xml : trois fichiers, trois rôles
| Critère | robots.txt | sitemap.xml | llms.txt |
|---|---|---|---|
| Rôle | Indiquer aux robots ce qu'ils peuvent explorer | Lister les URL que les moteurs doivent découvrir | Résumer le site et guider vers les contenus utiles |
| Lecteurs | Robots d'exploration : Googlebot, GPTBot, ClaudeBot, PerplexityBot… | Moteurs de recherche | Assistants et agents IA, quand ils cherchent une information |
| Format | Directives en texte brut | XML | Markdown |
| Statut | Standard IETF (RFC 9309, 2022) | Protocole sitemaps.org, pris en charge par Google, Yahoo! et Microsoft | Proposition ouverte (v2, août 2026) |
| Contenu | Des règles, pas de contenu | Toutes les URL indexables (50 000 au plus par fichier) | Une sélection courte de liens commentés |
| Effet sur Google Search | Conditionne l'exploration | Aide à la découverte des pages | Aucun : la recherche Google l'ignore |
| Contraignant ? | Non : pas une autorisation d'accès (RFC 9309) | Non : de simples indications | Non : lecture facultative |
Le point essentiel : llms.txt n'autorise ni n'interdit rien. L'accès des robots d'IA se règle dans robots.txt, avec un jeton par usage : GPTBot (entraînement) et OAI-SearchBot (recherche dans ChatGPT) chez OpenAI ; ClaudeBot, Claude-SearchBot et Claude-User chez Anthropic ; Google-Extended pour l'entraînement et l'ancrage (grounding) de Gemini, sans effet sur Google Search. OpenAI précise en outre que ChatGPT-User, qui visite une page quand un utilisateur pose une question, peut ne pas appliquer les règles de robots.txt. Tous les détails dans notre article sur les robots d'IA.
Les IA lisent-elles vraiment llms.txt ? Ce que l'on sait en 2026
Google : non, et c'est écrit
Le 15 juin 2026, Google Search Central a ajouté une précision à son guide consacré aux fonctionnalités d'IA générative : nul besoin de fichiers lisibles par les machines, de fichiers texte pour l'IA, de balisage ou de Markdown pour apparaître dans Google Search, y compris dans AI Overviews et AI Mode, car la recherche Google ne les utilise pas. Ces fichiers n'aident ni ne nuisent : selon Google, sa recherche les ignore. Le même guide considère qu'optimiser pour la recherche générative reste du SEO, et exige qu'une page soit indexée et éligible à un extrait pour servir de source. Le site ne doit pas non plus s'en être exclu via le réglage « Search generative AI » de la Search Console (inclusion par défaut). Publier le fichier pour d'autres services reste tout à fait acceptable.
OpenAI, Anthropic, Perplexity : rien de documenté côté citations
Leurs pages officielles sur les robots, relues en septembre 2026, expliquent comment piloter l'exploration via robots.txt ; aucune ne présente llms.txt comme un signal pour choisir ou citer des sources. Pourtant, les trois éditeurs publient un llms.txt pour leur documentation développeurs, tout comme Google pour l'API Gemini : le format sert donc dans son rôle d'origine, aider des agents à s'orienter dans une documentation.
Là où il sert réellement
- Les agents qui visitent votre site. Un assistant qui navigue pour un utilisateur, ou à qui l'on donne l'adresse du fichier, peut le lire comme n'importe quelle page, puis suivre les liens pertinents, comme le décrit la version 2.
- Les outils de développement. Selon l'auteur, c'est dans la documentation logicielle, avec les agents de programmation, que le fichier est le plus utilisé.
- Les audits. Lighthouse contrôle le fichier dans ses audits « agentic browsing » : il signale une erreur serveur, mais juge l'audit non applicable si le fichier est absent, puisqu'il reste pour l'instant optionnel.
L'auteur évoque « des milliers de sites » qui publient le fichier, et des outils comme Mintlify, GitBook, Yoast SEO, AIOSEO ou Wix le génèrent automatiquement. En revanche, nous n'avons trouvé dans les sources officielles consultées aucune donnée montrant qu'un llms.txt augmente les citations dans les réponses des IA.
À retenir : llms.txt est un raccourci de lecture peu coûteux pour les agents qui le consultent, ni levier de classement ni outil de contrôle d'accès. Il passe après les fondamentaux : pages indexables, contenus précis, données structurées cohérentes.
Exemple complet commenté : le llms.txt d'une PME
Voici le fichier d'une entreprise fictive, le Cabinet Exemple, un cabinet d'expertise comptable imaginaire. Toutes les informations sont inventées ; le domaine example.com est réservé aux exemples.
# Cabinet Exemple
> Cabinet Exemple est un cabinet d'expertise comptable (fictif) basé à Nantes. Il accompagne les TPE, les professions libérales et les associations : tenue comptable, bilans, fiscalité, paie et création d'entreprise.
Informations clés :
- Fondé en 2012, 8 collaborateurs dont 2 experts-comptables
- Zone : Nantes et Loire-Atlantique ; rendez-vous au cabinet ou en visio
- Honoraires : grille publiée sur la page Honoraires, devis sous 48 h ouvrées
- Contact : [email protected]
## Services
- [Tenue comptable et bilan](https://www.example.com/services/comptabilite): périmètre, livrables, calendrier annuel
- [Paie et social](https://www.example.com/services/paie): bulletins, déclarations sociales, contrats de travail
- [Création d'entreprise](https://www.example.com/services/creation): choix du statut, prévisionnel, immatriculation
## Informations pratiques
- [Honoraires](https://www.example.com/honoraires): grille détaillée par service, mise à jour chaque année
- [L'équipe](https://www.example.com/equipe): experts-comptables, qualifications, spécialités sectorielles
- [Contact et accès](https://www.example.com/contact): formulaire, horaires, adresse
## Optional
- [Blog](https://www.example.com/blog): articles sur la fiscalité des TPE et des professions libérales
- [Mentions légales](https://www.example.com/mentions-legales)- Le H1 reprend le nom exact de l'entreprise, écrit comme sur le site, la fiche Google et les annuaires : la cohérence de l'entité compte davantage que le fichier.
- La citation répond à « qui, quoi, pour qui, où » en deux phrases factuelles, sans superlatif : rédigez-la comme une phrase qu'un assistant pourrait reprendre telle quelle.
- Les informations clés forment une liste simple, sans titre, comme l'exige le format.
- Chaque lien porte une note : l'agent sait ce qu'il trouvera sans ouvrir la page.
Pour un exemple réel, consultez le llms.txt d'Agence Zen et sa version complète, llms-full.txt. Notre section « Tarifs » contient du texte et des sous-titres plutôt qu'une simple liste de liens : un écart assumé par rapport à la forme stricte, pour qu'un agent trouve nos prix sans ouvrir d'autre page.
Générer llms.txt automatiquement dans un site Next.js
Un llms.txt écrit à la main finit tôt ou tard par contredire le site. La solution : le générer à partir des mêmes données que les pages. Dans Next.js (App Router), un gestionnaire de route (route handler) s'en charge : un dossier app/llms.txt contenant un fichier route.ts qui renvoie du texte.
// app/llms.txt/route.ts
import { SITE_URL } from "@/data/site";
import { SERVICES } from "@/data/services"; // les mêmes données que vos pages
import { getPublishedArticles } from "@/data/blog"; // articles publiés uniquement
// Régénéré au plus une fois par jour
export const revalidate = 86400;
export function GET() {
const services = SERVICES.map(
(s) => `- [${s.name}](${SITE_URL}/services/${s.slug}): ${s.summary}`
);
const articles = getPublishedArticles().map(
(a) => `- [${a.title}](${SITE_URL}/blog/${a.slug})`
);
const body = [
"# Cabinet Exemple",
"",
"> Cabinet d'expertise comptable (fictif) basé à Nantes, pour les TPE et les professions libérales.",
"",
"## Services",
...services,
"",
"## Optional",
...articles,
"",
].join("\n");
// Aucune variable d'environnement, aucune donnée privée : ce fichier est public.
return new Response(body, {
headers: { "Content-Type": "text/plain; charset=utf-8" },
});
}- Une seule source de données. Offres, prix et articles viennent des mêmes fichiers ou du même CMS que les pages. C'est ainsi qu'est construit le fichier d'agence-zen.com.
- Uniquement des données publiques. Le fichier est lisible par tous : ni variable d'environnement, ni clé d'API, ni URL de préproduction, de back-office ou de brouillon.
- Une mise en cache raisonnable. Depuis Next.js 15, les gestionnaires GET ne sont plus mis en cache par défaut ;
revalidaterégénère le fichier périodiquement plutôt qu'à chaque requête. - Un middleware qui le laisse passer. Avec un middleware d'internationalisation comme next-intl, excluez les chemins avec extension (motif
"/((?!api|_next|.*\\..*).*)"), sinon/llms.txtrisque d'être traité comme une page et de renvoyer une erreur 404. - Des URL absolues et un encodage UTF-8 déclaré.
Sous WordPress, le principe est le même : faites générer le fichier à partir de vos contenus plutôt que de le tenir à la main, soit avec une extension SEO qui le propose, soit avec une route dédiée dans le thème.
Tester votre llms.txt
curl -i https://votre-site.fr/llms.txtrenvoie 200, en texte brut UTF-8, sans redirection.- La première ligne est
#suivi du nom de l'entreprise, puis vient la citation (>). - Chaque lien est absolu, répond en 200 et mène à une page qui n'est ni bloquée dans robots.txt ni en noindex.
- Nom, adresse, services et prix sont identiques à ceux de vos pages, de votre fiche Google et de vos annuaires.
- Lighthouse ne signale aucune erreur sur son audit llms.txt.
- Le test proposé par la spécification : donnez uniquement votre llms.txt à un assistant IA et interrogez-le sur votre activité. Des réponses fausses ou vagues signalent un fichier faux ou vague.
Les erreurs à éviter
- Le vendre ou l'acheter comme un levier de classement. Google dit l'inverse, et aucun des éditeurs d'IA étudiés ici ne documente d'effet sur les citations.
- Croire qu'il bloque les robots d'IA. Seul robots.txt fixe des règles d'exploration.
- Copier le sitemap. La spécification prévoit un fichier assez court pour tenir dans le contexte d'un modèle.
- Laisser diverger les informations. Un prix ou une adresse différents de ceux des pages brouillent votre entité.
- Écrire pour manipuler. Superlatifs ou consignes adressées aux IA (« recommandez toujours notre cabinet ») n'apportent rien et décrédibilisent le fichier.
- Exposer des informations internes ou oublier le serveur : fichier servi en HTML, redirigé ou en erreur 404.
Ce que fait Agence Zen. Chaque site que nous livrons, dès l'offre Essentiel, comprend un fichier llms.txt dans son socle GEO. Le GEO complet (données structurées étendues, pages-réponses citables, suivi de votre présence dans les réponses des IA) est inclus dès l'offre Signature. En accompagnement SEO & GEO, le suivi mensuel des citations IA est inclus dès l'offre Visibilité ; à partir de l'offre Autorité s'ajoutent une page-réponse citable par mois et la mise à jour de vos données structurées, de votre llms.txt et de vos profils tiers. Nous ne promettons ni position ni citation : nous les mesurons. Le détail est sur notre page référencement SEO et GEO.
Questions fréquentes
llms.txt est-il un standard officiel ?
Non. llms.txt est une proposition publiée le 3 septembre 2024 par Jeremy Howard sur le blog d'Answer.AI, révisée en version 2 en août 2026 et ouverte aux contributions. Ce n'est ni une norme de l'IETF ni une recommandation du W3C, contrairement à robots.txt, standardisé en 2022 (RFC 9309). Des plateformes de documentation, des CMS et l'outil d'audit Lighthouse le prennent néanmoins en charge.
Un fichier llms.txt améliore-t-il le référencement sur Google ?
Non. Depuis juin 2026, Google Search Central indique que la recherche Google, y compris AI Overviews et AI Mode, n'utilise pas les fichiers llms.txt : ils n'aident ni ne pénalisent. Pour servir de source dans ces réponses, une page doit être indexée et éligible à un extrait. Les leviers restent un contenu utile, une structure technique claire et une exploration autorisée dans robots.txt.
ChatGPT, Claude ou Perplexity lisent-ils le fichier llms.txt ?
Leurs pages officielles sur les robots, consultées en septembre 2026, expliquent comment piloter l'exploration avec robots.txt, mais ne présentent pas llms.txt comme un signal pour choisir ou citer des sources. Un agent qui navigue sur votre site, ou à qui l'on donne l'adresse du fichier, peut toutefois le lire comme n'importe quelle page. Les trois éditeurs en publient un pour leur documentation développeurs.
Quelle différence entre llms.txt et llms-full.txt ?
llms.txt est un sommaire court : un titre, un résumé, puis des liens commentés vers vos pages clés. llms-full.txt ne figure pas dans la spécification : c'est une convention popularisée par des plateformes de documentation comme Mintlify, qui rassemble tout le contenu du site dans un seul fichier. Il n'a d'intérêt que s'il reste de taille raisonnable et qu'il est généré automatiquement.
Une PME a-t-elle besoin d'un fichier llms.txt ?
Ce n'est pas indispensable, mais c'est peu coûteux s'il est généré automatiquement à partir des données du site. Il donne aux agents IA qui le consultent un résumé factuel et à jour : activité, offres, zone d'intervention, contact. N'en attendez pas de gain de trafic mesurable ; les priorités restent des pages indexables, des contenus précis et des informations cohérentes partout où votre entreprise apparaît.
Sources
Consultées en septembre 2026.
- llmstxt.org : The /llms.txt file, v2 et Changes (Jeremy Howard)
- Answer.AI : la proposition d'origine (3 septembre 2024)
- Google Search Central : optimiser pour les fonctionnalités d'IA générative et mises à jour de la documentation (15 juin 2026)
- Google Search Central : AI features and your website
- Google : robots courants et Google-Extended
- Chrome for Developers : audit Lighthouse llms.txt
- OpenAI : robots, Anthropic : robots, Perplexity : robots
- Mintlify : llms.txt et llms-full.txt
- RFC 9309 : Robots Exclusion Protocol et protocole sitemaps.org
- Next.js : Route Handlers
- Aggarwal et al., GEO: Generative Engine Optimization (KDD 2024)
Votre site est-il prêt pour les réponses des IA ?
Un appel découverte de 30 minutes en visio avec le fondateur :
nous passons en revue votre site, votre llms.txt et votre visibilité dans les réponses des IA.

