
Non, le fichier llms.txt n'a aucun effet sur le référencement naturel (SEO). Aucun des principaux fournisseurs d'IA ne l'utilise comme critère de classement, et les robots d'indexation IA que vous essayez de séduire ne le récupèrent pratiquement jamais ; par conséquent, le fait d'en fournir un ne vous permettra pas d'être davantage référencé par ChatGPT, Perplexity ou le moteur de recherche IA de Google.
Mais “ l'ignorer ” serait aller trop loin. Ce même fichier accomplit discrètement un travail concret dans une autre couche, le « web agentique », où des assistants de codage et des agents IA le récupèrent sans cesse. Voici les preuves, ainsi qu'un avis honnête pour vous aider à décider si vous devriez le publier.
Principaux enseignements
- En ce qui concerne les citations issues de la recherche par IA, le fichier llms.txt ne sert à rien pour l'instant : sur 515 millions de requêtes émanant de bots IA, seules 408 ont concerné ce fichier.
- Google a déclaré officiellement (en juillet 2025) qu'il ne prenait pas en charge le fichier llms.txt, qu'il a comparé à la balise meta « keywords » désormais obsolète.
- L'adoption n'est pas une question de consommation : environ un site sur dix en propose une, mais les robots de recherche et de réponse continuent de l'ignorer.
- Elle s'avère véritablement utile en tant qu'infrastructure d'agents (B2A) : les assistants de codage des IDE et les serveurs MCP la récupèrent régulièrement, et le shopping par agents est la prochaine étape.
- C'est donc une solution peu coûteuse qui vaut la peine d'être envisagée si des agents peuvent récupérer vos documents ou votre catalogue de produits, et non une astuce pour manipuler le classement de l'IA.
À quoi sert le fichier llms.txt ?
llms.txt est une proposition de norme qui vous invite à placer un fichier Markdown à l'emplacement /llms.txt répertorier vos pages les plus importantes avec des descriptions d'une ligne, afin que les grands modèles linguistiques puissent les lire et comprendre votre site de la même manière que robots.txt guide les robots d'indexation. Il a été introduit par Jeremy Howard
Jeremy HowardCo-fondateur d'Answer.AI / fast.aiCo-fondateur d'Answer.AI et de fast.ai, et auteur de la proposition « llms.txt ».XWikipédiaLinkedIn d'Answer.AI en septembre 2024 et consigné à l'adresse llmstxt.org.
Il existe également une version plus complète llms-full.txt qui intègre le contenu réel de la page plutôt que de se contenter d'y renvoyer par un lien.
Cela ressemble à une infrastructure et donne l'impression d'être proactif, et c'est précisément pour cette raison que cela s'est répandu dans les fils de discussion sur le référencement et les présentations des agences avant même que quiconque ait pu vérifier si les machines de l'autre côté le lisaient réellement.

Les robots d'indexation basés sur l'IA le lisent-ils vraiment ?
Non, les robots d'indexation des IA ne lisent pratiquement jamais le fichier llms.txt. Limy.AI a constaté que 515 382 577 requêtes de robots d'IA sur une période de 90 jours, pour l'ensemble des marques qu'il suit, et uniquement 408 parmi ces demandes, celles qui concernaient /llms.txt, soit environ 0,000081 TP3T du total, comme indiqué dans son Guide llms.txt 2026.
Il s'agit là de données à échelle logarithmique, et non d'une simple impression subjective, et c'est ce chiffre qui fait pencher la balance en faveur du référencement naturel. GPTBot, ClaudeBot, PerplexityBot, OAI-SearchBot et Google-Extended ignorent massivement le fichier et récupèrent directement votre code HTML, de la même manière qu'ils récupèrent celui de tout le monde.
Les internautes que les sites tentent d'attirer passent leur chemin sans même s'arrêter devant le panneau de bienvenue.
Il convient de distinguer deux chiffres que les gens ont tendance à confondre. Une étude de SE Ranking portant sur 300 000 domaines a estimé le taux d’adoption à environ 10%, et ce chiffre est souvent cité comme preuve de l’efficacité de la méthode. Or, cela prouve uniquement que la campagne marketing a porté ses fruits.
L'adoption par les éditeurs n'est pas la même chose que l'utilisation par les moteurs de recherche, et c'est cette dernière qui est déterminante.
Ce qu'en dit Google
Google affirme ne pas prendre en charge le format llms.txt et ne pas avoir l'intention de le faire. En juillet 2025, Gary Illyes
Gary IllyesAnalyste, Google SearchAnalyste au sein de l'équipe « Search Relations » de Google et source d'information de premier plan en matière d'exploration et d'indexation.LinkedInXCentre de recherche l'a confirmé officiellement, et John Mueller
John MuellerSpécialiste en référencement, GoogleResponsable de la promotion de Google Search et principal porte-parole officiel du service des relations publiques de Google Search.LinkedInXCentre de recherche Si l'on compare ce fichier à la balise « keywords » d'antan, une balise que les propriétaires de sites remplissaient consciencieusement mais que les moteurs de recherche ignoraient tout simplement.
Aucun des principaux fournisseurs (OpenAI, Anthropic, Google, Meta, Mistral) ne s'est engagé à utiliser le fichier llms.txt comme critère dans un moteur de recherche ou une interface de réponse en production.
La comparaison entre les mots-clés et les balises meta est plus pertinente qu'il n'y paraît. Cette balise a échoué parce qu'elle permettait aux propriétaires de sites de déclarer eux-mêmes la pertinence de leur contenu sans aucune vérification ; elle a donc été détournée et abandonnée. Le fichier llms.txt présente le même défaut structurel : vous sélectionnez vous-même les pages de votre site qui vous semblent importantes, alors que les systèmes de recherche sont précisément conçus pour ne pas se fier aux déclarations intéressées.
Google a depuis officialisé cette position par écrit. Son Guide de mai 2026 sur l'optimisation des fonctionnalités d'IA générative indique aux propriétaires de sites que le fichier llms.txt n'est pas nécessaire pour ses fonctionnalités d'IA, et étend ce raisonnement au découpage de contenu, à la réécriture spécifique à l'IA et à un schéma spécial d'IA, le tout présenté comme relevant toujours uniquement du référencement naturel (SEO).
Je considère cela comme une recommandation pertinente pour le référencement sur Google Search, sans plus. Google a tout intérêt à ce que vos efforts restent axés sur Google Search ; je ne considérerais donc pas son avis comme la référence absolue sur un sujet que d’autres systèmes prennent clairement en compte. Les journaux d’exploration règlent déjà la question du référencement naturel ; le guide ne fait que le confirmer, sans aborder la couche des agents.
La partie où l'on dit “ c'est un raté ” manque
Le fichier llms.txt n'apporte rien aux citations issues de la recherche par IA, mais il joue un rôle concret dans la couche « agentique », où les agents IA agissent pour le compte d'un utilisateur, récupèrent du contexte et accomplissent des tâches. Limy appelle cette couche « Business-to-Agent » (B2A), et c'est précisément sur cette distinction que se fondent les critiques dédaigneuses.
| Moteurs de recherche et de réponse basés sur l'IA | Web agentique (agents IDE, MCP, utilisation d'outils) | |
|---|---|---|
| Le fichier llms.txt est-il utile ? | De manière non mesurable | Oui, concrètement |
| Qui va le chercher ? | Presque personne aujourd'hui | Cursor, Claude Code, Copilot, Windsurf, serveurs MCP |
| Pourquoi ? | Les robots d'indexation explorent déjà très bien les pages HTML | Les agents disposent de fenêtres contextuelles restreintes et ont besoin d'un code Markdown épuré |
Les assistants de codage tels que Cursor, Claude Code, GitHub Copilot et Windsurf recherchent /llms.txt lorsqu'il est intégré à un site de documentation, et les serveurs MCP s'articulent autour de cette technologie. Les plateformes de documentation telles que Mintlify, Vercel et GitBook l'intègrent désormais par défaut, ce qui explique pourquoi Stripe, Cloudflare et Anthropic en disposent toutes. Pour ces équipes, il s'agit d'une exigence en matière d'expérience développeur, et non d'une stratégie de référencement.
Le cas qui importe le plus pour ce public est commerce par agent. Lorsque les agents commencent à rechercher des produits pour leurs clients (“ trouve-moi des chaussures de course à moins de $150 qui soient livrées d’ici vendredi ”), ils ont besoin d’une interface claire et lisible par machine pour le catalogue, les prix et les règles d’expédition, plutôt que d’avoir à analyser un code HTML de catégorie encombré.
Les magasins qui remettent aux agents un dossier bien présenté seront ceux avec lesquels les agents pourront réellement conclure des transactions, et la plupart des détaillants n'en fournissent pas encore. Si vous souhaitez en savoir plus sur cette évolution, j'ai abordé le sujet dans Pourquoi votre flux de produits devient un facteur déterminant pour le classement.
Ce qui contrôle réellement la façon dont l'IA voit votre site
Ce sont en réalité le fichier robots.txt, les journaux de votre serveur, le code HTML « answer-first » et votre autorité en ligne qui déterminent la manière dont l'IA perçoit votre site. Le fichier llms.txt ne figure pas sur cette liste. Si votre objectif est d'améliorer votre visibilité dans les résultats de recherche générés par l'IA plutôt que le routage des agents, vous feriez mieux de concentrer vos efforts sur les mécanismes que les moteurs de recherche prennent réellement en compte :
- robots.txt et règles au niveau des robots. Il s'agit du fichier que les robots d'indexation basés sur l'IA lisent réellement. Autorisez ou interdisez l'accès à GPTBot, ClaudeBot, CCBot, Google-Extended et PerplexityBot au niveau des directives ; c'est cela, le véritable contrôle, appliqué à grande échelle.
- Journaux du serveur. Le seul relevé fiable indiquant quels robots IA ont accédé à quelles URL et quelles données ils ont récupérées. Si vous souhaitez gérer l'exploration par l'IA, analysez les journaux plutôt que de vous fier à un fichier que les robots ignorent.
- Contenu de type "réponse d'abord" en HTML brut. Les agents de récupération qui n'exécutent pas JavaScript ont besoin que votre réponse figure dans la charge utile initiale, pour la même raison la taille de la charge utile et le blocage du rendu vous coûteront tranquillement des classements.
- Autorité et originalité. L'IA cite ses sources pour les mêmes raisons que celles qui déterminent le classement dans les résultats de recherche : la fiabilité, les liens et les informations que l'on ne trouve nulle part ailleurs. Voir mon point de vue sur comment les signaux hors site construisent cette autorité.
Alors, est-ce que le fichier llms.txt est efficace pour le référencement ?
Non, le fichier llms.txt n'a aucun effet sur le référencement naturel (SEO), et il ne s'agit pas non plus d'un outil de référencement basé sur l'IA. Les journaux d'exploration et la position officielle de Google le confirment, et toute agence promettant une augmentation du nombre de mentions grâce à ce fichier en fait une publicité mensongère.
Si c'est la seule raison pour laquelle vous aviez l'intention de l'ajouter, consacrez plutôt cette heure à l'optimisation du fichier robots.txt, à l'analyse des journaux et à la recherche de contenu qui mérite d'être mis en avant.
Cela dit, je vous conseillerais tout de même d'en publier une, courte et soigneusement élaborée, si les agents sont susceptibles de puiser dans votre domaine, surtout si vous gérez une documentation pour développeurs ou une boutique en ligne qui s'oriente vers un processus de paiement automatisé. Cela prend environ une demi-journée, c'est vraiment utile au niveau de la couche des agents, et si un moteur de recherche majeur venait un jour à franchir le pas, vous seriez déjà prêt.
Considérez-la comme une infrastructure B2A peu coûteuse, et non comme une astuce pour améliorer le référencement, et vous l'aurez ainsi bien cernée.
Journal des mises à jour
12 juillet 2026
- Nous avons réécrit les premières lignes de chaque section afin que chaque titre trouve une réponse directe dans les deux ou trois premières lignes, les détails à l'appui étant déplacés plus bas. Il s'agit d'un test d'extractibilité délibéré que nous menons sur notre propre page, et nous publierons le résultat quel qu'il soit ; les faits, les chiffres, les sources, les liens et le verdict restent inchangés.
6 juillet 2026
- Ajout du guide d'optimisation de l'IA générative publié par Google en mai 2026, dans lequel Google indique désormais dans sa propre documentation que le fichier llms.txt et les tactiques similaires réservées à l'IA ne sont pas nécessaires pour ses fonctionnalités d'IA ; nous avons maintenu notre position selon laquelle ce fichier a toujours sa place dans la couche d'agent.
23 juin 2026
- Ajout de fiches d'information contextuelles sur les experts cités (John Mueller, Gary Illyes, Jeremy Howard) lorsque l'on passe la souris sur leur nom.
22 juin 2026
- Ajout d'une table des matières et d'une légende au tableau comparatif B2A.
13 juin 2026
- J'ai réécrit l'article dans un style plus clair et plus sobre, et j'ai ajouté un résumé des points clés.
- J'ai revérifié les chiffres en les comparant à la source Limy.AI (515 382 577 requêtes de bots IA, 408 occurrences dans le fichier llms.txt, période de 90 jours, environ 101 adoptions de TP3T selon SE Ranking) et aux déclarations de Google datant de juillet 2025.
- Rééquilibrage de la position : nous avons maintenu la conclusion selon laquelle le fichier llms.txt n'apporte rien aux citations issues de la recherche en IA, mais nous avons accordé davantage d'importance à son utilisation réelle dans le cadre du B2A (récupération d'agents et de MCP, commerce agentique) au lieu de l'écarter.
Vous souhaitez que nos publications apparaissent plus souvent sur Google ?
En un clic, Google affichera ce site dans votre rubrique « À la une ».
