4 min read

Exemples et modèles de llms.txt : que mettre dans le vôtre (et comment le valider)

Modèles llms.txt à copier-coller pour un site produit, un site de docs et un blog ; les champs qui comptent, les erreurs qui rendent le fichier inutile, et une checklist de validation.

llms.txtGEOAI CrawlersTechnical SEO
Exemples et modèles de llms.txt : que mettre dans le vôtre (et comment le valider)

llms.txt est une table des matières lisible par machine à l'adresse /llms.txt : un court résumé markdown de qui vous êtes, plus la poignée de pages qu'un système d'IA devrait lire en premier. Il n'accorde pas l'accès au crawl (c'est le rôle de robots.txt) et ce n'est pas un signal de classement ; c'est un fichier de routage qui rend la récupération moins coûteuse et plus précise. Après en avoir fait tourner un sur ce site pendant plus d'un an (voir notre rétrospective à 90 jours), voici les modèles qui valent leur coût et les vérifications de validation qui détectent ceux qui sont cassés.

L'anatomie qui fonctionne

# Product Name
> One-paragraph summary: what it is, for whom, what it does, pricing model.

## Core pages
- [Pricing](https://example.com/pricing): plans, limits, what each tier includes
- [Product overview](https://example.com/product): features, platforms, integrations
- [FAQ](https://example.com/faq): billing, data, cancellation

## Docs
- [Getting started](https://docs.example.com/start): install, first call, auth
- [API reference](https://docs.example.com/api): endpoints and schemas

Trois règles sous-tendent ce modèle :

  1. Le blockquote est la ligne qui compte. C'est le texte le plus susceptible d'être repris mot pour mot quand un modèle vous décrit. Rédigez-le comme une fiche d'annuaire : produit, audience, fonction, modèle de prix — un paragraphe, sans slogans.
  2. Cinq à quinze liens, pas cinquante. Le fichier est en concurrence pour l'attention lors d'une étape de récupération ; un mur de liens le dilue. Choisissez les pages qui répondent aux questions des acheteurs, pas votre sitemap.
  3. Chaque URL absolue et fonctionnelle. Les chemins relatifs et les 404 sont les deux façons les plus courantes dont un fichier par ailleurs correct devient un poids mort.

Variantes selon le type de site

  • Site produit : vue d'ensemble, tarifs, pages de comparaison/vs, changelog, FAQ.
  • Site de documentation : prise en main, authentification, les trois groupes d'endpoints les plus utilisés, guides de migration.
  • Blog/éditeur : les quatre articles piliers, la page à propos et les rapports de données — omettez les articles individuels.

Ce qu'il ne peut pas faire

Il ne fera pas entrer un crawler bloqué (robots.txt l'emporte), ne créera pas de citations là où le contenu est mince, et il est ignoré par les systèmes qui ne le récupèrent jamais. Sa valeur, c'est la précision : moins de résumés erronés, moins d'incidents du type « le modèle a décrit notre ancien tarif ».

Liste de vérification

  • Renvoie 200 avec text/plain ou du markdown à https://<domain>/llms.txt (pas un 404, pas du HTML).
  • La première ligne est un # Title ; un bloc résumé > suit.
  • Tous les liens sont absolus, en HTTPS et résolvent (scriptez une requête HEAD par ligne en CI).
  • Le résumé correspond à la description canonique utilisée dans les annuaires — une seule fiche de faits, partout (voir comment se classer dans ChatGPT, levier 2).
  • Moins de ~2 Ko. Si vous avez besoin de plus, il vous faut moins de liens, pas un fichier plus gros.
  • Mis à jour quand les tarifs ou le positionnement changent ; un llms.txt obsolète enseigne aux modèles vos anciens faits.

FAQ

Chaque site en a-t-il besoin ? Tout site qui veut être décrit avec précision par les systèmes d'IA, oui — c'est cinq minutes de travail avec les modèles ci-dessus. Cela compte surtout pour les produits à la tarification complexe ou aux renommages fréquents.

llms.txt ou robots.txt en premier ? robots.txt d'abord : l'accès avant le routage. Notre guide des crawlers d'IA couvre les règles d'accès et les agents qui les sous-tendent.

Faut-il lister les pages de comparaison des concurrents ? Non. llms.txt oriente les lecteurs vers vos faits canoniques. Les pages de comparaison vous concernant sur d'autres domaines relèvent de votre travail d'obtention de mentions, pas de votre fichier de routage.


Entretenir une empreinte d'annuaires avec la même description canonique que celle utilisée par votre llms.txt, c'est ce qui fait que les faits restent : soumettez votre produit sur aat.ee, permanent et dofollow à travers le réseau.

Vous avez créé quelque chose ?

Lancez-le sur aat.ee et soyez découvert

Listage dofollow permanent dans un annuaire indexé
Cité et recommandé par les assistants IA
Soumettez votre projet