Générateur LLMs.txt
Saisissez votre domaine. Le Générateur LLMs.txt explore le site, retient les pages qui méritent d'être montrées aux systèmes d'IA, les regroupe en sections et rédige une description pour chacune. Vous obtenez un llms.txt validé, modifiable avant publication.
La différence se joue au milieu du processus. Le générateur ne déverse pas votre sitemap dans un fichier texte : les URL sont filtrées, les pages importantes priorisées, et les descriptions viennent du contenu réel de la page, pas de la balise meta.
Comment ça marche
- Saisissez votre site. Ou indiquez un sitemap, ou collez votre propre liste d'URL.
- Le Générateur LLMs.txt explore et analyse. robots.txt, vos sitemaps et le contenu de chaque page.
- Il crée et valide le fichier. Sections, descriptions et contrôle de conformité.
- Vous relisez, modifiez et publiez. Rien n'est publié sans votre accord.
Plus qu'un convertisseur de sitemap en llms.txt
Un générateur simple fait un seul passage : sitemap en entrée, URL avec méta-descriptions en sortie. C'est ainsi que la page de connexion, le panier et cent articles de blog vides finissent dans un fichier publié.
| Fonction | DiagnoSEO | Autres générateurs |
|---|---|---|
| Explore le contenu réel des pages | ✅ | Variable |
| Filtre les URL sans valeur | ✅ | Variable |
| Priorise les pages importantes | ✅ | Variable |
| Crée des sections logiques | ✅ | Variable |
| Rédige les descriptions à partir du contenu | ✅ | Variable |
| Écrit dans la langue du site | ✅ | Variable |
| Validation intégrée | ✅ | Variable |
| Modification avant téléchargement | ✅ | Variable |
| Affiche les URL écartées et le motif | ✅ | Variable |
| Compare votre llms.txt existant | ✅ | Variable |
| Génère llms-full.txt | ✅ | Variable |
Ce que fait concrètement le Générateur LLMs.txt
- Découverte par le sitemap d'abord. Lit robots.txt et gère les index de sitemaps ainsi que les sitemaps compressés en gzip.
- Exploration de secours. Pas de sitemap ? Les pages sont trouvées via les liens internes de votre page d'accueil.
- Récupération en parallèle pour garder les explorations volumineuses rapides.
- Sélection intelligente des URL. Documentation, produits, services, tarifs, à propos et contact passent en premier.
- Suppression du bruit. Fichiers, connexion, panier, pagination, archives de tags et de dates, paramètres de filtre.
- Exclusions personnalisées. Ajoutez les fragments d'URL à ignorer, comme
/tag/ou?filter=. - L'équilibrage des sections empêche un gros blog d'écraser votre documentation.
- Nettoyage des titres. « Tarifs | Marque » devient « Tarifs ».
- Sections H2 plus une section
Optionalpour le contenu secondaire. - Résumé et descriptions de pages rédigés à partir du contenu réel, dans la langue de votre site.
- Repli sur la méta-description si le modèle est indisponible, pour toujours obtenir un fichier exploitable.
- Validation avant téléchargement, critères Chrome Lighthouse compris.
- Comparaison avec le llms.txt déjà publié sur votre domaine.
- Sources transparentes. Chaque URL retenue est listée et décochable ; chaque URL écartée indique pourquoi.
- llms-full.txt avec le contenu complet des pages, issu de la même exploration.
Qu'est-ce que llms.txt
llms.txt est un fichier Markdown décrit dans la proposition llmstxt.org, publiée par Jeremy Howard (Answer.AI) en septembre 2024 et mise à jour en v2 en août 2026. C'est une proposition portée par la communauté, pas une norme du W3C ni de l'IETF.
La structure est courte : un H1 avec le nom du site (seul élément obligatoire), un résumé en citation, un paragraphe de contexte facultatif, puis des sections H2 de liens Markdown où deux-points introduisent une note brève. Une section nommée Optional signale le contenu qu'un agent peut ignorer quand le contexte est serré.
Le fichier peut se trouver à la racine du domaine ou sur n'importe quel chemin à l'intérieur. La v2 autorise les fichiers à portée limitée : /docs/llms.txt couvre tout ce qui se trouve sous /docs/, et les agents doivent utiliser le fichier le plus spécifique applicable.
Qu'est-ce que llms-full.txt
llms-full.txt est une convention popularisée par les plateformes de documentation, hors spécification. Au lieu de liens avec descriptions, il contient le contenu complet de vos pages en Markdown, réuni en un seul document.
Il prend tout son sens là où les utilisateurs posent des questions détaillées aux assistants IA : documentation, produits SaaS, bases de connaissances. Les deux fichiers proviennent de la même exploration et restent donc cohérents.
llms.txt, sitemap.xml et robots.txt
Trois fichiers, trois rôles. Ils ne se remplacent pas, et un site bien tenu sert les trois.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Destiné à | Robots d'exploration | Moteurs de recherche | Modèles de langage et agents |
| Répond à | Ce qui peut être exploré | Quelles URL existent | De quoi parlent les pages clés |
| Format | Directives | XML | Markdown |
| Contient des descriptions | Non | Non | Oui |
| Contrôle l'accès | Oui | Non | Non |
| Portée | Domaine | Domaine | Domaine ou chemin |
Pourquoi un éditeur peut en vouloir un
- Contrôle. Vous choisissez les pages et les descriptions que vous exposez, au lieu de laisser un modèle les déduire d'un HTML rempli de navigation et de scripts.
- Lisibilité machine. Le Markdown est plus facile à exploiter pour les agents compatibles qu'une page rendue.
- Économie de contexte. Une carte concise tient dans une fenêtre de contexte où votre site entier n'entrerait jamais.
- Coût faible. Rien à maintenir dans votre stack, aucun effet sur les performances.
Le format est publié par les équipes documentation d'OpenAI, Anthropic et Gemini, et généré automatiquement par des plateformes comme Mintlify, GitBook et Wix, ainsi que par les extensions Yoast SEO et AIOSEO.
Ce que llms.txt ne fait pas
- Il ne bloque aucun robot. Le contrôle d'accès relève de robots.txt.
- Il ne remplace ni robots.txt ni sitemap.xml.
- Il ne garantit pas de citations dans ChatGPT, Perplexity, Gemini ou Claude.
- Ce n'est pas un facteur de classement confirmé chez Google.
- Il n'est pas obligatoire, et son adoption varie selon les systèmes d'IA.
- Il ne compense ni un contenu pauvre ni un site inaccessible aux robots.
Promettre davantage de citations grâce au seul fichier, c'est promettre ce que personne ne peut démontrer aujourd'hui. La valeur tient au contrôle et à la lisibilité.
Validation et contrôle Chrome Lighthouse
Chrome Lighthouse 13.3 a ajouté la catégorie expérimentale Agentic Browsing. L'un de ses audits valide les propriétés de base d'un llms.txt publié : un titre H1, au moins un vrai lien Markdown de la forme [Titre](URL) et une longueur supérieure à 50 caractères.
Le générateur reproduit les contrôles de cet audit. C'est un contrôle de structure, pas un signal de classement dans la recherche Google. Pour l'audit lui-même, un fichier absent est traité comme non applicable, tandis qu'un fichier publié qui échoue peut être signalé comme une erreur.
C'est pourquoi la validation s'exécute avant le téléchargement : structure llmstxt.org, les trois critères Lighthouse, URL en double, liens vers des domaines tiers et taille du fichier. Le Checker et validateur LLMs.txt distinct contrôle un fichier déjà en ligne, y compris l'accessibilité de ses liens.
Comment publier le fichier
Servez-le en texte brut à l'adresse votredomaine.fr/llms.txt, à côté de robots.txt. Pour ne décrire qu'une partie du site, placez-le sur ce chemin, par exemple votredomaine.fr/docs/llms.txt. Après l'envoi, ouvrez l'adresse et vérifiez que vous voyez du Markdown et non une page 404.
| Plateforme | Emplacement |
|---|---|
| cPanel ou hébergement mutualisé | /public_html/llms.txt |
| WordPress | Racine du site, pas /wp-content/ |
| Next.js, Nuxt, Astro, React | /public/llms.txt |
| Laravel, Symfony | /public/llms.txt |
| Shopify | Contenu → Fichiers, puis rediriger /llms.txt vers le fichier envoyé |
| Webflow | Paramètres du site, code personnalisé ou envoi de fichier |
| Netlify, Vercel, GitHub Pages | Ajoutez-le au dossier public du dépôt |
Ce qui a sa place dans le fichier
Un llms.txt est une sélection, pas une archive. Pour la liste complète des URL, votre sitemap existe déjà.
- SaaS et documentation : présentation du produit, tarifs, démarrage, référence d'API, journal des versions.
- E-commerce : catégories, produits phares, livraison, retours, guides des tailles. Ni variantes, ni filtres, ni pagination.
- Services locaux : chaque prestation séparément, zone d'intervention, tarifs ou devis, à propos et contact.
- Éditeurs : pages piliers et contenus permanents plutôt que les cinquante derniers articles.
Questions fréquentes
-
Un fichier Markdown avec le nom de votre site, un résumé court et une liste de pages clés accompagnées de descriptions. Il donne aux modèles de langage et aux agents une carte concise de vos contenus, au lieu de les laisser la déduire du HTML.
-
Non. C'est une proposition portée par la communauté, décrite sur llmstxt.org, aujourd'hui en v2, et non ratifiée par le W3C ni l'IETF. La conformité désigne ici la structure décrite là-bas.
-
Non. Aucun système ne l'exige. Vous le publiez volontairement, pour maîtriser ce que vous exposez aux outils d'IA compatibles et la façon dont c'est décrit.
-
Rien ne le prouve, et cet outil ne le promet pas. Le fichier rend vos contenus plus lisibles et vous donne la main sur les descriptions, mais ce n'est ni un facteur de classement confirmé ni une garantie de citation.
-
Google indique que le fichier n'est pas nécessaire à ses fonctionnalités d'IA dans la recherche. Par ailleurs, Chrome Lighthouse peut valider les propriétés de base d'un fichier publié dans ses audits expérimentaux. C'est un contrôle de structure, pas un signal de classement.
-
Servez-le en texte brut à la racine de votre domaine, à côté de robots.txt. La v2 autorise aussi les fichiers sur n'importe quel chemin :
/docs/llms.txtcouvre le contenu sous/docs/, et les agents doivent utiliser le fichier le plus spécifique. -
llms.txt est un index sélectif de liens avec descriptions. llms-full.txt contient le contenu complet des pages en Markdown. Le premier est la carte, le second le territoire, et seul le premier fait partie de la spécification.
-
Un sitemap liste toutes les URL pour les moteurs, sans description ni hiérarchie. robots.txt contrôle l'accès des robots. llms.txt est une carte courte et sélective avec du contexte, calibrée pour la fenêtre de contexte d'un modèle.
-
Oui. Sans sitemap, les pages sont découvertes via les liens internes de votre page d'accueil, en priorisant documentation, produits et services.
-
Oui. Dans la limite quotidienne, vous obtenez le fichier complet, sans filigrane ni aperçu tronqué. Les formules payantes augmentent la limite de pages et ajoutent llms-full.txt.
Générez votre llms.txt
Saisissez votre domaine et obtenez un fichier llms.txt structuré, validé et modifiable, prêt à publier. Aucune collecte manuelle d'URL. Vous avez déjà un fichier ? Vérifiez-le avec le Checker et validateur LLMs.txt.