Komtop
GEO et moteurs IA

llms.txt sert-il vraiment à quelque chose pour les IA ?

12 minutes de lectureRédigé par Baptiste Lacroix

Résumez et explorez ce contenu avec l'IA

En résumé

Le fichier llms.txt promet de rendre un site plus lisible pour les IA génératives. En pratique, les mesures disponibles en 2026 racontent l'inverse : Google déclare officiellement ne pas l'utiliser, une étude sur plus de 137 000 domaines montre que 97 % des fichiers publiés ne reçoivent aucune requête, et ChatGPT lui-même, interrogé sur le sujet, le classe en dernière position des leviers utiles. OpenAI, Anthropic et Google publient pourtant chacun leur propre llms.txt, mais pour leur documentation développeur, un usage différent d'un site vitrine ou e-commerce. Ce que montrent les données : le fichier ne nuit pas, mais il ne remplace ni le contenu, ni la structuration, ni l'autorité, les vrais leviers de citation par les IA.

Non, pas dans l'état actuel des choses : les mesures disponibles en 2026 ne montrent aucun effet du fichier llms.txt sur les citations par les IA génératives. Google affirme noir sur blanc ne pas l'utiliser, une étude portant sur plus de 137 000 domaines montre que 97 % des fichiers n'ont reçu aucune requête en mai 2026, et ChatGPT, interrogé directement sur le sujet, le classe en dernière position d'un tableau de leviers utiles. La suite de cet article détaille ces preuves, source par source, et ce qui fonctionne réellement à la place.

Ce sujet crée pourtant de la confusion. Des extensions WordPress le génèrent en un clic, des outils SEO le recommandent par précaution, et la presse spécialisée se divise entre prudence et scepticisme. Cet article tranche avec des sources datées et vérifiables plutôt qu'avec des opinions : la position officielle de Google, celle d'OpenAI et de Perplexity, et la plus grande étude disponible sur l'adoption réelle du fichier.

Qu'est-ce que le fichier llms.txt exactement ?

Le fichier llms.txt est un fichier texte au format Markdown, placé à la racine d'un site (à l'adresse /llms.txt), qui propose un résumé du site et des liens vers ses contenus jugés les plus utiles pour une intelligence artificielle. Il a été proposé le 3 septembre 2024 par Jeremy Howard, et sa version 2 a été mise à jour le 10 août 2026 (llmstxt.org). L'idée de départ : donner aux agents IA un point d'entrée plus court que l'ensemble du site.

Concrètement, le fichier contient un titre en H1, une courte description en citation, puis des sections de liens classés par thème (pages principales, documentation, ressources optionnelles). Il diffère de robots.txt en une phrase : robots.txt autorise ou bloque l'accès des robots à des pages, llms.txt se contente de présenter le site, sans aucune autorité pour empêcher ou permettre quoi que ce soit. Un fichier llms.txt mal écrit ne bloque donc jamais un robot, il n'est simplement pas consulté.

  • Pensé pour l'inférence, c'est-à-dire le moment où une IA génère une réponse, pas pour l'entraînement des modèles
  • Coexiste avec robots.txt et sitemap.xml sans les remplacer : les trois fichiers ont des rôles distincts
  • Format Markdown volontairement simple, sans balisage complexe, pour rester lisible par un humain comme par une machine

Les IA lisent-elles vraiment ce fichier ?

Non, très majoritairement non. Sur les 137 210 domaines suivis par Ahrefs et ayant reçu du trafic en mai 2026, environ 38 000 ont publié un fichier llms.txt, soit 28 % du panel (Ahrefs, étude publiée le 15/06/2026, données de mai 2026, vérifiée le 13/08/2026), mais 97 % de ces fichiers n'ont reçu strictement aucune requête sur le mois. Un suivi indépendant distinct, portant sur plus de 3 millions de sites, mesure de son côté une adoption multipliée par 8,8 en un an, passée de 4 088 fichiers recensés en juin 2025 à plus de 36 000 en mai 2026 (Originality.ai, vérifié le 13/08/2026). Poser le fichier ne garantit donc en rien qu'il soit lu, ni par un humain, ni par une IA.

Robot IALit-il llms.txt ?Ce que l'on sait, vérifié le 13/08/2026
Googlebot / Google-Extended (Google)Non, affirmé sans détour« Google Search itself doesn't use them » : la documentation officielle de Google le dit clairement (mise à jour le 10/07/2026, vérifiée le 13/08/2026).
GPTBot / OAI-SearchBot / ChatGPT-User (OpenAI)Non confirméLe signal documenté par OpenAI pour être découvert dans la recherche ChatGPT est l'autorisation de OAI-SearchBot dans robots.txt, pas llms.txt (centre d'aide OpenAI, vérifié le 13/08/2026).
ClaudeBot / Claude-User (Anthropic)Non confirmé publiquementAnthropic publie son propre fichier llms.txt, mais pour sa documentation développeur, sans déclaration publique sur une lecture systématique des fichiers tiers.
PerplexityBot / Perplexity-UserNon documenté comme prérequisLa documentation officielle de Perplexity conditionne l'apparition en résultats à l'autorisation de PerplexityBot dans robots.txt, sans mention de llms.txt (mise à jour le 16/07/2026).
Ensemble des robots IA, sur 137 210 domaines suivisQuasiment jamais97 % des fichiers publiés n'ont reçu aucune requête en mai 2026 ; parmi les rares fichiers consultés, les robots IA nommés (type ChatGPT, Perplexity) ne représentent qu'environ 1 % des requêtes (Ahrefs, étude du 15/06/2026).

Le peu de trafic qui touche malgré tout ces fichiers vient en grande partie d'outils d'audit SEO qui vérifient sa simple présence, pas d'IA qui viendraient s'en servir pour construire une réponse. Parmi les rares requêtes enregistrées, les robots IA de récupération identifiés, comme ceux de ChatGPT ou de Perplexity, ne représentent qu'environ 1 % du total (Ahrefs, même étude).

Ce que déclarent officiellement Google, OpenAI, Anthropic et Perplexity

Google : une position sans ambiguïté

La documentation officielle de Google sur l'IA et la recherche est explicite : « You don't need to create new machine readable files, AI text files, markup, or Markdown to appear in Google Search (including its generative AI capabilities), as Google Search itself doesn't use them. » Cette page a été mise à jour le 10 juillet 2026 et vérifiée le 13 août 2026 (developers.google.com). Gary Illyes, de l'équipe Search de Google, a par ailleurs déclaré publiquement que Google ne prend pas en charge llms.txt et n'a pas prévu de le faire.

John Mueller, porte-parole de Google, a comparé llms.txt à l'ancienne balise meta keywords sur Reddit, relayé par Search Engine Journal (17/04/2025) et Search Engine Land (09/07/2025) : aucun service IA n'a confirmé l'utiliser, et les journaux de serveur le prouvent. Il l'a aussi décrit comme une béquille temporaire, utile aux outils de code qui analysent une documentation technique, pas au référencement d'un site grand public. Si le fichier apparaît parfois sur certaines propriétés de Google, c'est qu'un système interne l'y a ajouté, pas parce que la recherche s'en sert.

OpenAI : un autre signal, documenté celui-là

OpenAI ne mentionne llms.txt nulle part dans sa documentation pour les éditeurs. Le signal qu'elle documente réellement pour être découvert dans la recherche ChatGPT est l'autorisation du robot OAI-SearchBot dans le fichier robots.txt (centre d'aide OpenAI pour les éditeurs et développeurs, vérifié le 13/08/2026). Interrogé directement sur l'utilité de llms.txt pour être cité, ChatGPT le classe lui-même en dernière position, avec 1 à 2 étoiles sur 5, sur un tableau de leviers qu'il a généré spontanément, loin derrière le contenu utile et l'autorisation des robots IA légitimes.

Anthropic et Perplexity : silence public, documentation qui pointe ailleurs

Anthropic publie son propre fichier llms.txt, mais pour sa documentation développeur, sans jamais communiquer publiquement sur une lecture systématique des fichiers llms.txt publiés par des sites tiers. Perplexity, de son côté, documente PerplexityBot et le respect de robots.txt comme condition pour apparaître dans ses résultats (centre d'aide Perplexity, mis à jour le 16/07/2026), sans mentionner llms.txt à aucun moment. Les deux laboratoires laissent donc le même vide que Google et OpenAI : aucune déclaration qui rattache une citation par leur IA à la présence de ce fichier.

Ce que montrent les mesures de terrain en 2026

L'étude Ahrefs sur 137 210 domaines reste la preuve la plus large disponible aujourd'hui sur l'usage réel du fichier. Menée sur les données de trafic de mai 2026 et publiée le 15 juin 2026, elle montre que 28 % des domaines suivis (environ 38 000) publient un fichier llms.txt, mais que 97 % de ces fichiers n'ont reçu absolument aucune requête sur le mois. Un suivi indépendant distinct, portant sur plus de 3 millions de sites, mesure une adoption multipliée par 8,8 en un an entre juin 2025 et mai 2026 (Originality.ai, vérifié le 13/08/2026). Le fichier se répand, sans être lu.

  • Adoption : environ 38 000 des 137 210 domaines suivis publient un fichier llms.txt en mai 2026, soit 28 % du panel (Ahrefs, 15/06/2026)
  • Fichiers jamais lus : 97 % des fichiers publiés n'ont reçu aucune requête sur le mois mesuré (Ahrefs, même étude)
  • Part des robots IA nommés dans le peu de trafic restant : environ 1 %, le reste venant surtout d'outils d'audit SEO (Ahrefs, même étude)

Même les 3 % de fichiers consultés le sont donc majoritairement par des outils qui vérifient sa présence, pas par des IA qui produisent une réponse citée. Sur les 1 000 sites les plus visités au monde, l'adoption reste comparable et limitée : 8,7 % en juin 2026, selon un suivi mensuel indépendant sur le classement Tranco top 1 000 (rapport mis à jour le 06/08/2026). Le fichier progresse en nombre, pas en usage.

Pourquoi OpenAI, Anthropic et Google publient-ils quand même leur propre llms.txt ?

Parce que leur usage n'a rien à voir avec la citation dans une recherche grand public. OpenAI, Anthropic et Google publient chacun un fichier llms.txt, mais pour leur documentation technique destinée aux développeurs, un cas d'usage pensé pour des agents de code qui lisent une API, pas pour dire aux autres sites web de faire pareil pour espérer être cité par ChatGPT ou Gemini sur une recherche commerciale.

  • OpenAI : developers.openai.com/llms.txt, résumé de sa documentation développeur
  • Anthropic : platform.claude.com/docs/llms.txt, même logique pour sa documentation technique
  • Google : ai.google.dev/gemini-api/docs/llms.txt, pour la documentation de l'API Gemini

Ces trois fichiers servent un agent de code qui doit comprendre rapidement une API, un usage technique précis, très éloigné d'un site vitrine qui espère être mentionné dans une réponse ChatGPT sur une recherche commerciale. C'est cette nuance, rarement posée aussi clairement, qui évite de conclure que le fichier ne sert jamais à rien : il sert, mais pas à ce que la plupart des sites lui demandent.

Faut-il quand même créer ce fichier pour son site ?

Cela dépend du type de site. Pour un site vitrine, un site e-commerce, un site de services ou un blog, la réponse est non, pas en priorité aujourd'hui : aucune mesure disponible en 2026 ne relie la présence du fichier à une citation supplémentaire par une IA. Pour un site de documentation technique ou d'API consommée par des agents de code, en revanche, l'usage a un sens réel et mesuré, puisque c'est exactement le public que le fichier cible.

Poser le fichier ne coûte presque rien, quelques minutes suffisent, et il ne nuit à rien non plus. Le vrai risque n'est pas de le créer, c'est de croire qu'il remplace le travail qui compte réellement. Avant de s'y attarder, un audit SEO complet donne une photographie plus utile des vrais chantiers à traiter en priorité.

Comment écrire un fichier llms.txt, si vous décidez d'en poser un

Le format reste volontairement simple. Un titre en H1 avec le nom du site ou de l'entreprise, une courte description en citation qui résume l'activité, puis des sections de liens classées en H2 (pages principales, ressources optionnelles), chaque lien accompagné d'une description courte. Voici un exemple générique, à adapter avec vos propres pages :

Exemple de fichier llms.txt
# Nom de l'entreprise

> Description en une phrase de l'activité et du positionnement.

Informations de contexte utiles : secteur d'activité, zone géographique, ce qui distingue l'offre.

## Pages principales

- [Services](/services): détail de l'offre et des prestations
- [À propos](/a-propos): présentation de l'équipe et de l'historique
- [Blog](/blog): articles de référence sur le secteur

## Optional

- [Mentions légales](/mentions-legales)

Trois bonnes pratiques ressortent de la spécification officielle : un langage concis, sans phrases longues ; une description courte pour chaque lien, qui donne à elle seule une idée du contenu de la page ; et l'absence de jargon non expliqué, puisque le fichier doit rester lisible aussi bien par un humain que par une machine.

Ce qui fait vraiment citer un site par une IA en 2026

Ce qui fait citer un site par une IA en 2026, ce sont les fondations du GEO : un contenu qui répond directement à une question, une structure lisible, et une autorité réelle construite dans la durée. Aucun de ces trois leviers ne se résume à un fichier posé une fois à la racine du site.

  • Un contenu qui répond directement à la question posée, dès les premières phrases, plutôt qu'une introduction qui tourne autour du sujet
  • Des données structurées qui aident une IA à comprendre le sujet, le prix ou les caractéristiques d'une page sans avoir à deviner
  • Une autorité construite par les mentions, les avis et la présence sur des sources tierces reconnues du secteur
  • Un fichier robots.txt correctement configuré pour autoriser les robots IA légitimes, le vrai signal qui conditionne la découverte du site, contrairement à llms.txt
  • Une stratégie pensée pour être référencé sur ChatGPT et les autres IA conversationnelles, pas seulement sur Google

Un bon travail de référencement classique nourrit largement la citation par les IA : les deux disciplines partagent la même base, un contenu utile, une structure claire et une autorité vérifiable. La différence se joue ensuite sur des détails propres aux IA génératives, pas sur un fichier de plus à la racine du site. Pour savoir où votre site en est réellement, un audit GEO mesure ce qui vous cite aujourd'hui et ce qui vous en empêche.

Questions fréquentes sur le fichier llms.txt

Quelle est la différence entre llms.txt et robots.txt ?

robots.txt autorise ou bloque l'accès des robots à certaines pages du site, c'est un fichier de permission. llms.txt, lui, se contente de présenter le site et de proposer des liens vers ses contenus principaux, sans aucune autorité pour bloquer ou autoriser quoi que ce soit. Les deux fichiers coexistent, mais seul robots.txt a un effet mesuré sur la découverte du site par les robots IA.

Un fichier llms.txt mal fait peut-il nuire au référencement ?

Non. Google confirme officiellement ne pas utiliser ce fichier, ni pour son moteur de recherche classique, ni pour ses fonctionnalités d'IA générative. Un fichier mal rédigé, incomplet ou absent n'a donc aucune conséquence mesurée sur le classement d'un site, que ce soit sur Google ou sur les IA conversationnelles étudiées dans cet article.

Combien de temps faut-il pour créer un fichier llms.txt ?

Quelques minutes suffisent pour un site simple : un titre, une description et quelques liens vers les pages principales. Certains outils de référencement, comme Yoast SEO, proposent même de le générer automatiquement. Le temps n'est donc pas l'obstacle, c'est plutôt l'utilité réelle du fichier qui reste à démontrer avant d'y consacrer plus qu'un rapide essai.

Soyez exactement là où vos clients vous cherchent.

Réserver un appel