En bref / Points clés
- llms.txt est une proposition, pas un standard : nom H1, résumé en blockquote, sections de liens H2, et une section 'Optional' que les contextes plus courts peuvent ignorer.
- Aucun service IA majeur n'a annoncé l'utiliser, et Mueller note que les robots ne demandent même pas le fichier — les attentes en matière de classement doivent être proches de zéro.
- Publiez-en un quand même : dix minutes, risque zéro, des consommateurs de niche réels dans l'outillage pour développeurs, et l'exercice de curation est un travail de positionnement qui en vaut la peine.
- L'heure de visibilité IA mesurable dépend de l'accès des crawlers, du texte rendu côté serveur, des données structurées et de la couverture par des tiers — et non des fichiers auto-déclarés.
Peu de fichiers présentent un écart aussi important entre la fréquence à laquelle ils sont vendus et la fréquence à laquelle ils sont lus. Une industrie artisanale de générateurs commercialise désormais llms.txt comme un levier de classement AI-SEO ; pendant ce temps, l'autorité la plus citée en matière de recherche affirme que les robots d'indexation ne demandent même pas le fichier. Les deux points méritent d'être compris précisément, car la bonne approche — consacrer dix minutes, ne pas en attendre grand-chose — ne prend tout son sens qu'une fois les deux aspects pris en compte.
La spécification, précisément
D'après llmstxt.org : un fichier markdown UTF-8 servi à la racine /llms.txt, structuré exactement dans cet ordre —
- Un H1 avec le nom du projet ou du site. Le seul élément requis.
- Une citation (blockquote) avec un résumé d'une ligne.
- Optionnellement, du markdown libre court avec le contexte qu'un modèle devrait connaître avant de suivre les liens.
- Zéro ou plusieurs sections délimitées par des H2 — chacune étant une liste markdown de liens
[nom](https://url), éventuellement suivis de:et d'une courte note. - Une section optionnelle littéralement intitulée "Optional" — la seule partie du fichier que les contextes d'IA plus courts sont autorisés à ignorer ; les éléments secondaires y sont placés.
L'idée est l'économie de jetons (tokens) : au lieu qu'un système d'IA explore et tronque votre site au hasard, vous lui fournissez dix liens bien choisis avec une ligne de contexte chacun. Certains projets publient également un compagnon étendu (généralement llms-full.txt) intégrant le contenu complet des pages, bien que cette variante soit une convention d'implémentation plutôt qu'une partie de la spécification proprement dite.
Qui le lit réellement en 2026
Inventaire honnête : l'écosystème de la proposition l'a adopté — FastHTML, nbdev et les projets Answer.AI le publient, les annuaires communautaires indexent les sites qui en proposent un, et les plateformes de documentation ont ajouté une prise en charge en un clic, si bien que le fichier est courant dans la documentation des outils de développement. Plusieurs agents de codage et outils de réponse le récupéreront lorsqu'ils seront orientés vers un site. Ce qui n'est pas arrivé, selon l'observation des journaux de serveur de Mueller, c'est une exploration systématique par les principaux services d'IA — OpenAI, Anthropic et Google n'ont rien annoncé, et les analyses de logs continuent de montrer que les grands robots d'indexation ne demandent pas le fichier. Si votre raison de publier est "ChatGPT va enfin nous comprendre", les preuves ne sont pas là.
Cet article vous plaît ? Recevez-en un comme celui-ci chaque matin.
un e-mail par jour · désinscription en deux clics · aucun traqueur tiers
L'argumentaire contre, en version renforcée
La comparaison de Mueller avec la balise meta keywords est la version la plus incisive de l'objection : llms.txt est un contenu auto-déclaré — « voici ce qu'un propriétaire de site affirme être le sujet de son site » — et les signaux auto-déclarés meurent car ils sont facilement manipulables. « À ce stade, pourquoi ne pas simplement vérifier le site directement ? » Un robot d'indexation capable de lire vos pages réelles n'a pas besoin de votre communiqué de presse à leur sujet. Cette logique a tué la balise keywords, et rien dans llms.txt n'est structurellement immunisé contre cela.
L'argument pour y consacrer au moins dix minutes
- Le coût est vraiment dérisoire. Un fichier statique, aucune étape de build, aucun risque. Les paris asymétriques avec un risque quasi nul ne nécessitent pas une conviction absolue.
- Il existe déjà des consommateurs. Les outils pour développeurs, les agents spécialisés dans la documentation et les moteurs de réponse qui acceptent une indication de site le lisent — c'est une niche, mais c'est réel, et c'est surtout précieux pour les produits dont les acheteurs sont des développeurs.
- La curation est la vraie valeur ajoutée. Choisir les dix pages qui expliquent le mieux votre produit — et écrire une ligne honnête sur chacune — est un travail de positionnement que vous devriez faire, qu'un robot récupère le résultat ou non.
- Valeur d'option. Si un moteur majeur annonce un jour son support, les sites ayant des fichiers propres seront prêts ; tous les autres devront se précipiter.
Comment en écrire un qui mérite d'être lu
Curez, ne déversez pas : un sitemap régurgité en markdown va à l'encontre du principe même. Dix à vingt liens, chacun accompagné d'une note expliquant ce qu'un lecteur y apprend — pas un texte marketing, mais un contexte destiné au modèle. Placez les changelogs, les pages légales et les archives dans Optional. Maintenez-le à jour de la même manière que votre sitemap, et servez-le en tant que markdown UTF-8 brut à la racine. Notre générateur llms.txt gratuit compose un fichier conforme aux spécifications dans le navigateur — rien n'est stocké, aucune inscription requise — avec la même mise en garde honnête que cet article.
Où passe la vraie heure
Si vous avez une heure pour la visibilité IA, llms.txt représente les dix dernières minutes, pas les cinquante premières. Les leviers mesurables, dans l'ordre : autoriser ou non les robots d'indexation IA (robots.txt), servir du texte lisible sans exécuter de JavaScript, fournir des titres, des descriptions et des données structurées, et soigner votre profil d'autorité — le test gratuit de dix secondes couvre ces quatre points. Au-delà de la technique, ce qui influence les recommandations IA, c'est ce que les autres pages de confiance disent de vous — la couche de couverture et de citations que nous cartographions dans le guide des outils de visibilité IA, et, par souci de transparence, la couche sur laquelle notre propre Stork Wire se positionne. Les fichiers auto-déclarés sont une courtoisie. Les preuves tierces sont le signal de classement — aussi bien pour les moteurs de recherche que pour les moteurs de réponse.

