Retour au carnet KLA
Article · KLA

llms.txt : pourquoi KLA a rendu son site lisible aux agents IA, et ce qu'on observe depuis

llms.txt est une convention proposée par Jeremy Howard en septembre 2024 pour rendre un site web lisible par les agents IA. KLA l'a déployé sur son site au printemps 2026, après avoir constaté que les agents restituaient une version générique et partiellement fausse de l'organisme. Récit factuel, observations et invitation.

27 mai 2026·7 min de lecture·Pierre Medina

Il y a quelques semaines, on a posé un fichier sur le site de Knowledge Ladder Academy. Cinquante lignes de markdown, à la racine, accessible à n'importe qui qui sait taper /llms.txt après notre domaine. Aucun humain ne lira jamais ce fichier, et c'est tout l'intérêt.

Je voudrais expliquer pourquoi KLA l'a fait, ce qu'on observe depuis, et ce que ça change pour les organisations qui pilotent un site web qui sert leur activité en 2026.

Le contexte : une convention qui vient de fast.ai, pas d'hier matin

Ce fichier s'appelle llms.txt, et la convention vient d'une proposition de Jeremy Howard, l'un des cofondateurs de fast.ai et ancien président de Kaggle. Il l'a publiée en septembre 2024, donc il y a déjà plus d'un an et demi. L'idée est très simple, presque banale : si les agents IA visitent désormais les sites web pour répondre à leurs utilisateurs, ces sites doivent leur être lisibles. Comme robots.txt a permis aux moteurs de recherche de comprendre la structure des sites dans les années quatre-vingt-dix, llms.txt propose de faire la même chose pour les LLM.

Pendant un an, on a vu passer la proposition Howard dans la veille technique de KLA sans agir. Trop tôt, on pensait. Pas encore le moment. C'était une erreur d'évaluation que je voudrais documenter ici, parce que beaucoup d'organismes de formation et de cabinets de conseil reproduisent la même hésitation aujourd'hui.

Ce qui a fait basculer KLA

Téléphone tenu en main avec interface conversationnelle, métaphore du test direct des agents IA
Téléphone tenu en main avec interface conversationnelle, métaphore du test direct des agents IA

Au début du printemps 2026, j'ai pris dix minutes pour tester ce que les principaux agents IA disent de Knowledge Ladder Academy quand on les interroge. J'ai posé des questions volontairement larges sur le catalogue de formations, sur la méthode pédagogique, sur les spécialités, sur le parcours du fondateur, à Claude, à ChatGPT, à Perplexity, à Gemini. Le résultat est un KLA générique, partiellement faux. Homepage React que l'agent interprète mal, trois posts LinkedIn récents pris hors contexte, un article de blog historique qui n'est plus représentatif de la méthode actuelle. Sur certaines questions, des frameworks qu'on n'utilise pas dans nos formations apparaissent comme nos sujets-phares. Sur d'autres, des clients qu'on n'a jamais accompagnés. Sur d'autres encore, des positions doctrinales qui sont à l'opposé de ce qu'on défend en salle.

Ce constat a décidé KLA à passer une demi-journée pour écrire le llms.txt du site. Pas un sujet de SEO classique, pas une optimisation marketing, juste reprendre la main sur ce qu'un agent IA peut dire de l'organisme quand quelqu'un l'interroge.

Comment c'est construit, en pratique

Le fichier est un sommaire markdown structuré du site. Une balise titre, une phrase de présentation en blockquote, puis une série de sections, chacune regroupant des liens vers les pages clés avec une description courte d'une ou deux phrases. Pour KLA, six sections : à propos, formations certifiantes et qualifiantes, conseil et accompagnement dirigeants, publications et ressources, contact et mentions légales, plus une section optionnelle pour les liens externes utiles.

Important sur la technique. Le fichier doit être servi avec le bon content-type, qui est text/markdown, pas text/plain. La nuance paraît dérisoire, elle est critique, parce que sans content-type correct certains agents tronquent ou reformatent mal le contenu. C'est le piège dans lequel l'équipe est tombée en première installation, et qui a coûté une demi-journée supplémentaire pour reconfigurer côté serveur. Si vous n'avez pas la main sur la couche infra de votre site, faites-le faire correctement la première fois par votre prestataire ou votre équipe technique.

Ce qu'on observe depuis

Tableau de bord d analyse sur ordinateur, suivi des observations terrain
Tableau de bord d analyse sur ordinateur, suivi des observations terrain

Plusieurs choses. D'abord, quand j'interroge à nouveau les principaux agents sur "Knowledge Ladder Academy formation agile à l'échelle" ou "KLA conseil RTE SAFe", la qualité de restitution monte clairement par rapport à ce qu'elle était il y a deux mois. Les agents arrivent à pointer le bon catalogue, les bonnes formations certifiantes, la bonne page de conseil, le bon livre publié sous la marque KLA. Avant, certains agents inventaient ou recyclaient des informations anciennes. Maintenant, ils suivent la carte qu'on leur a posée.

Ensuite, KLA ne dépend plus uniquement de Google et du SEO classique pour exister dans la mécanique de découverte. Les deux canaux coexistent désormais, et personne ne sait encore lequel pèsera le plus dans deux ans. Mais si une part croissante des dirigeants finit par chercher des prestataires via leur agent plutôt que via une recherche Google, le llms.txt KLA est la carte d'identité de l'organisme dans ce canal. Sans lui, KLA n'est pas absent, KLA est flou. Et flou est pire qu'absent quand un agent doit choisir parmi cinq options à présenter à son utilisateur.

Enfin, et c'est plus subtil, c'est devenu un acte de cohérence avec ce que KLA raconte dans ses interventions et sur LinkedIn depuis plusieurs semaines. Quand on dit aux dirigeants que les agents IA sont en train de transformer la mécanique de coordination, d'arbitrage et de découverte dans leurs entreprises, on peut difficilement leur dire ça sans avoir d'abord rendu notre propre site lisible aux agents. Le geste précède la parole, sinon la parole sonne creux.

Les limites honnêtes

C'est encore tôt. La convention llms.txt n'est pas universellement adoptée par tous les agents IA, et certains continuent de crawler comme avant sans regarder le fichier. L'effet réel sur la qualité de restitution agent par agent est difficile à mesurer finement aujourd'hui, faute d'instrumentation publique. Et un fichier mal rédigé, qui surpromet ou qui ne reflète pas le contenu réel des pages, peut produire des restitutions trompeuses qui se retournent contre l'organisme. Comme un mauvais CV peut faire pire qu'un bon silence.

Mais le ratio coût-bénéfice reste très favorable. Une demi-journée de travail intellectuel, zéro coût récurrent, et un actif qui se valorise au fur et à mesure que les agents IA deviennent un canal de découverte sérieux pour les dirigeants.

Ce qu'on invite à faire, si vous pilotez un site qui sert votre activité

Allez voir s'il existe un llms.txt à la racine de votre domaine. Tapez votredomaine.fr/llms.txt dans votre navigateur. Si vous tombez sur une page d'erreur 404, vous êtes dans le cas général en 2026. Posez-en un dans les prochaines semaines, sans précipitation mais sans attendre non plus. Listez vos pages clés, écrivez deux lignes par page, vérifiez que le fichier est servi avec le bon content-type, et laissez tourner.

Le canal IA n'attendra pas que tout le monde se réveille pour devenir significatif. Il est déjà significatif aujourd'hui pour une part minoritaire de la cible CIO et dirigeants, et cette part va grandir vite. Les organisations qui auront posé leur carte tôt seront restituées correctement. Les autres seront ce qu'un agent reconstitue à partir d'une homepage qu'il interprète mal.

Le llms.txt KLA est ici si vous voulez voir à quoi ça ressemble : www.knowledgeladder.academy/llms.txt.

Et si le sujet plus large de la dette de coordination que l'IA fait remonter à la surface dans les organisations vous intéresse, KLA a publié un article de fond là-dessus il y a quelques jours.

Édité par Knowledge Ladder Academy, organisme de formation Qualiopi.