Créez un fichier llms.txt qui indique aux assistants d'IA quelles pages de votre site comptent vraiment.
llms.txt est un fichier markdown publié à la racine d'un site — /llms.txt — qui remet aux grands modèles de langage une carte organisée de votre contenu au lieu de les laisser deviner. La proposition, publiée sur llmstxt.org par Jeremy Howard en septembre 2024, définit un squelette volontairement rigide pour pouvoir être analysé sans ambiguïté : un H1 avec le nom du site ou du projet, un bloc de citation facultatif contenant un résumé d'un paragraphe, puis des sections H2 dont le corps est une liste à puces de liens markdown, chacun éventuellement suivi de deux-points et d'une courte description. Une section nommée « Optional » a un sens particulier : ces liens peuvent être ignorés quand la fenêtre de contexte est étroite.
Ce générateur construit exactement cette structure. Vous renseignez le nom, le résumé et autant de sections que nécessaire, en ajoutant une ligne par lien ; la sortie est assemblée en markdown valide, avec le bloc de citation appliqué ligne par ligne, les crochets des titres échappés pour qu'ils ne cassent pas la syntaxe des liens, les espaces réduits afin que chaque entrée tienne sur une seule ligne, et les domaines nus promus en https:// tandis que les chemins relatifs commençant par / sont laissés intacts. Les sections vides et les liens sans URL sont ignorés plutôt qu'émis en markdown cassé, et le fichier terminé se télécharge sous le nom llms.txt, prêt à être déposé.
Vaut-il la peine de le publier ? Réponse honnête : llms.txt est une proposition communautaire, pas une norme qu'un éditeur d'IA se serait publiquement engagé à lire, et il ne vous fera pas citer dans une réponse d'IA à lui seul. Ce qu'il apporte est peu coûteux et sans risque — un seul petit fichier, déjà adopté par un nombre croissant de sites de documentation — et il impose un exercice utile : décider quelles vingt pages expliquent réellement votre produit. Considérez-le comme le compagnon de robots.txt (qui contrôle l'exploration) et de sitemap.xml (qui liste toutes les URL pour les moteurs de recherche), et non comme leur remplaçant. Le fichier est généré dans votre navigateur et n'est jamais envoyé nulle part.
# Nom du site → > résumé d'un paragraphe → ## Section → - [Titre du lien](https://url): courte description. Les sections nommées « Optional » peuvent être ignorées par les outils dont la fenêtre de contexte est limitée.
Il donne aux assistants d'IA une liste courte et sélectionnée des pages qui expliquent le mieux votre site, dans un markdown qu'ils peuvent lire directement, au lieu de les laisser explorer et deviner à partir d'un HTML chargé de navigation.
À la racine du domaine, servi en texte brut sur https://votresite.com/llms.txt, au même endroit que robots.txt.
Aucun fournisseur d'IA n'a confirmé publiquement le faire. llms.txt est une proposition ouverte réellement adoptée par des sites de documentation, et le publier coûte peu, mais méfiez-vous de toute promesse de trafic d'IA garanti.
sitemap.xml liste toutes les URL pour les moteurs de recherche, robots.txt indique ce qui peut être exploré, et llms.txt sélectionne la poignée de pages à lire en premier, avec des descriptions écrites pour un modèle plutôt que pour un robot.
C'est une convention complémentaire qui intègre le contenu markdown complet des pages listées dans un seul grand fichier, au lieu d'y renvoyer par des liens. Cet outil génère le fichier d'index, llms.txt.
Non. Le markdown est assemblé sur votre appareil par du JavaScript, et le téléchargement est produit localement.
Vai.la transforme n'importe quelle URL en lien court avec statistiques de clics, QR Code et votre propre biolink.
Vai.la n'est pas responsable de l'utilisation des outils ni des décisions prises sur la base de leurs résultats.