🔎 L'article en bref
- Le fichier llms.txt a été proposé en septembre 2024 pour aider les IA à lire les sites plus facilement, sans ambition SEO à l'origine.
- Google a officiellement confirmé en mai-juin 2026 que ce fichier n'a aucun effet sur le référencement, ni positif ni négatif — y compris dans les AI Overviews et l'AI Mode.
- Les études sur des centaines de milliers de domaines montrent que 97% des fichiers llms.txt ne reçoivent aucune requête de bot IA.
- Le vrai cas d'usage reste le web agentique : agents de code comme Cursor, Claude Code ou GitHub Copilot.
- Pour la majorité des sites, ce n'est pas une priorité SEO — mais si ton CMS le génère automatiquement, autant le faire bien.
Depuis un an, on te vend le fichier llms.txt comme le « robots.txt de l'IA » : un fichier magique qui ferait apparaître ton site dans ChatGPT, Perplexity ou les AI Overviews de Google. Sauf que début 2026, Google a tranché publiquement, des études ont épluché des centaines de milliers de sites… et le verdict est beaucoup moins glamour que le pitch. On a creusé le sujet pour toi : c'est quoi vraiment, qui le lit (spoiler : presque personne), et faut-il quand même l'installer.
C'est quoi, llms.txt, concrètement ?

Le concept est né en septembre 2024, proposé par Jeremy Howard (Answer.AI). À l'origine, l'idée n'avait rien à voir avec le SEO : il voulait régler un problème purement technique. Les modèles de langage ont une « fenêtre de contexte » limitée, et transformer une page HTML bourrée de menus, de scripts, de pubs et de JavaScript en texte propre est à la fois difficile et imprécis pour une IA.
D'où l'idée : un simple fichier texte, placé à la racine de ton domaine (tonsite.fr/llms.txt), écrit en Markdown, qui sert de plan de lecture pour les IA. Une sorte de « liste de lecture recommandée » qui dit à un modèle de quoi parle ton site, quels contenus comptent le plus et où les trouver, sans le bruit du HTML.
Attention à deux confusions fréquentes : ce n'est pas un fichier de type robots.txt (il ne bloque rien, ne contrôle rien), et ce n'est pas la même chose que publier des versions Markdown de tes pages. C'est juste un fichier d'index.
Le format des liens est rigide : - [Titre](URL): Description. Un agent parse ce fichier ligne par ligne, donc la moindre déviation casse la lecture. Et la section ## Optional a un sens sémantique : un agent qui manque de contexte sait qu'il peut l'ignorer en priorité. Tu y mets tes pages à faible valeur.
Le débat : Google a (enfin) tranché
C'est là que ça devient intéressant — et que le pitch marketing prend l'eau. Pendant des mois, llms.txt a été promu comme un « quick win » GEO incontournable. Des plugins l'ont intégré (Yoast, Rank Math), des guides ont fleuri partout. Puis Google a mis les choses au clair, à répétition.
Septembre 2024 : Jeremy Howard propose le standard pour résoudre un problème de fenêtre de contexte. Aucune ambition SEO à l'origine.
2025 - début 2026 : l'industrie SEO s'empare du fichier et le rebaptise « levier de visibilité IA ». Les plugins WordPress se mettent à le générer automatiquement.
15 mai 2026 : le guide d'optimisation IA de Google Search classe explicitement llms.txt parmi les tactiques que les propriétaires de sites peuvent ignorer pour les AI Overviews et l'AI Mode.
Juin 2026 : Google ajoute une note officielle « Clarifying guidance on llms.txt files » : le fichier n'est pas nécessaire pour Google Search et ne crée ni effet positif ni effet négatif sur la visibilité.
John Mueller (Google) a été particulièrement direct. Sur le podcast Search Off the Record, il a expliqué que llms.txt ne peut pas servir aux systèmes LLM à départager les sites — résumant l'idée par : en gros, tu dis juste à ces systèmes que tu as « le meilleur site du monde ». Il a comparé le fichier à la balise meta keywords, en notant qu'aucun service IA ne l'utilisait et que les bots ne le réclamaient même pas.
Gary Illyes et Amir Taboul ont confirmé la même position lors du Search Central Live Deep Dive Asia Pacific : Google ne poursuit pas le sujet. Et le raisonnement est limpide — les AI Overviews et l'AI Mode puisent dans le même index Google Search que le ranking classique. Le fichier n'a donc aucun effet sur les surfaces IA de Google.
👉 L'argument « mais Google a un llms.txt ! » : oui, des sites Google en ont un. Mueller a clarifié que ce n'était pas un signe d'adoption — le CMS interne de Google a simplement ajouté le support, et certaines équipes ne l'ont pas retiré. Ce n'est pas un endorsement.
Le « pinch test » : qui lit vraiment ce fichier ?
Pour sortir du débat d'opinion, le mieux reste de regarder les logs serveurs. Est-ce que les bots IA vont réellement chercher le fichier ? Plusieurs études de 2026 ont fait l'exercice. Les chiffres sont sans appel.
👉 97% des fichiers llms.txt n'ont reçu aucune requête en mai 2026, d'après une étude Ahrefs portant sur 137 000 domaines. Sur 180 000 requêtes IA et 57 bots suivis pendant 6 mois (The SEO Framework), aucun bot n'est venu chercher le fichier.
Le test de The SEO Framework est particulièrement parlant : six mois de données, 57 bots IA, 180 000 requêtes liées à l'IA, et pas un seul bot venu réclamer un llms.txt. Ni Googlebot, ni GPTBot, ni ClaudeBot. Un zéro pointé.
Côté volumétrie massive, le constat se confirme : sur plus de 515 millions d'événements de trafic de bots IA analysés, en filtrant sur les user-agents qui comptent vraiment pour les citations — GPTBot, ClaudeBot, PerplexityBot, OAI-SearchBot, Google-Extended — la part de requêtes touchant /llms.txt est statistiquement négligeable.
Une étude sur 300 000 domaines n'a trouvé aucune corrélation statistique entre la présence d'un llms.txt et le fait d'être cité par les LLM. Aujourd'hui, en 2026, personne ne peut honnêtement te vendre ce fichier comme un facteur de ranking GEO.
Alors, on l'oublie ? Pas si vite.
Voilà la nuance que la plupart des prises de position ratent. Le fait que llms.txt ne serve quasiment à rien pour les citations dans la recherche IA ne veut pas dire qu'il est inutile partout. Il fait un vrai boulot dans une autre couche : le web agentique — la couche où des agents IA agissent pour le compte d'un utilisateur, récupèrent du contexte et accomplissent des tâches.
Les assistants de code (Cursor, Claude Code, GitHub Copilot, Windsurf…) et les agents qui ont besoin d'une carte propre d'un site sont les vrais consommateurs actuels du fichier. D'ailleurs, Mueller lui-même concède un cas d'usage : llms.txt peut aider une fois qu'un agent est déjà sur ton site, pour naviguer ou finir une tâche.
Installe-le si…
Tu gères un site de documentation technique, des API docs ou un produit SaaS. Des agents IA sont des visiteurs réels dans tes logs. Ton CMS le génère automatiquement : le coût est nul.
Cas validesNe perds pas de temps si…
Tu attends un gain de ranking ou de visibilité dans Google : il n'y en a aucun. Tu es un site vitrine ou e-commerce classique. Tu comptes y empiler 800+ liens en mode « deuxième sitemap ».
Cas à éviterTuto express : créer un llms.txt propre
Si tu coches une case valide ci-dessus, autant le faire bien. La barre technique est basse, c'est la qualité qui sépare un fichier utile d'un fichier bruité.
Respecte les 3 contraintes non négociables
Trois éléments déterminent si une IA peut lire le fichier : la structure Markdown, l'encodage UTF-8, et l'emplacement à la racine. Tu peux ajuster les URL et les libellés autant que tu veux, mais ne touche pas à ces trois-là. Et le nom est llms.txt (au pluriel) — llm.txt ne sera pas reconnu.
Vise 20 à 50 liens à haut signal
Un audit de 30 fichiers en production (mai 2026) a montré que l'échec le plus courant était de traiter le fichier comme un second sitemap surchargé. Garde uniquement : pages produits/services clés, pricing, docs techniques, FAQ utiles, pages de comparaison. Les pages à faible valeur vont dans la section ## Optional.
Soigne le blockquote de résumé comme si c'était un pitch de 10 secondes devant un investisseur. Évite le générique (« En savoir plus sur nos services »). Sois spécifique et orienté bénéfice : dis à l'IA exactement ce qu'elle va trouver et pourquoi c'est utile.
Sur WordPress, laisse le plugin bosser
Yoast SEO et Rank Math génèrent nativement le fichier depuis 2025. Une fois l'option activée, il est créé et mis à jour automatiquement — Yoast le régénère même chaque semaine via un cron. Pas de FTP, pas d'édition manuelle.
Vérifie que quelqu'un le lit (le honeypot)
Le réflexe data : checke tes logs d'accès pour les requêtes vers /llms.txt en filtrant par user-agents IA connus (GPTBot, ClaudeBot, PerplexityBot…). Astuce maligne : glisse un lien « piège » unique dans le fichier, que seul un lecteur automatisé suivrait, et surveille le trafic vers cette URL. Cloudflare Analytics fait ça très bien sans toucher aux logs bruts.
En février 2026, une agence a déployé un llms.txt statique couplé à du JSON-LD, puis soumis l'URL via la Search Console. Trois jours plus tard, Google AI Mode citait le fichier comme source principale pour une requête de marque. L'impact SEO direct reste nul, mais le fichier est devenu la « couche d'identité » que Google a utilisée pour ancrer les autres sources. À traiter comme un signal encourageant — le site avait déjà un JSON-LD costaud.
Ce qu'il faut retenir
Pour 90% des sites qu'on accompagne chez NOOKI, llms.txt n'est pas une priorité. Si ton objectif est d'apparaître dans Google (y compris ses surfaces IA) ou d'être cité par ChatGPT et Perplexity, ce fichier ne déplacera pas l'aiguille en 2026. Les données sont formelles.
Mais c'est un pari à coût quasi nul. Si ton CMS le génère tout seul, ou si tu as des docs techniques, un SaaS ou du trafic d'agents IA, installe-le proprement : le downside est zéro et tu prépares le terrain pour un web où les agents prendront de plus en plus de place. La vraie victoire, c'est ce que tu fais à côté — contenu solide, données structurées, E-E-A-T, autorité de marque. Le fichier texte, c'est la cerise, pas le gâteau.
👉 Tu te demandes si ta stratégie de contenu est vraiment prête pour la recherche IA ? C'est exactement notre terrain de jeu. Jette un œil à notre décryptage de l'optimisation pour les moteurs génératifs pour aller plus loin, ou viens nous en parler directement.
Non. Google a confirmé officiellement en mai et juin 2026 que le fichier n'est pas utilisé par Google Search et ne crée aucun effet, ni positif ni négatif, sur la visibilité — y compris dans les AI Overviews et l'AI Mode, qui puisent dans le même index que le ranking classique.
Aucun grand fournisseur d'IA (OpenAI, Google, Anthropic, Meta) n'a officiellement confirmé lire ou exploiter le fichier dans ses systèmes de production. Les analyses de logs montrent que la part de requêtes des bots de citation vers /llms.txt est statistiquement négligeable.
Le risque est faible mais pas nul. Le principal inconvénient : tu rends ta structure de contenu plus lisible aussi pour tes concurrents qui voudraient scraper ton site. Si tu as des contenus sensibles ou propriétaires, mieux vaut les protéger en amont plutôt que de les lister.
Malgré le nom, llms.txt n'est pas une directive de type robots.txt : il ne bloque rien et ne contrôle rien. C'est un fichier d'index qui suggère aux IA quels contenus prioriser. Robots.txt reste le seul standard officiellement reconnu par les moteurs pour gérer le crawl.
Vérifie tes logs d'accès pour les requêtes vers /llms.txt en filtrant par user-agents IA (GPTBot, ClaudeBot, PerplexityBot, Google-Extended). Tu peux aussi placer un lien « honeypot » unique dans le fichier et surveiller s'il est suivi. Cloudflare Analytics simplifie le suivi par user-agent sans toucher aux logs bruts.



