Genereer de llms.txt van je site.
llms.txt is een Markdown-index in de root van het domein: het vertelt het model wat de site is en welke pagina’s het lezen waard zijn. De tool leest je sitemap en bouwt het bestand, klaar om te publiceren.
- Module
- AEO/GEO
- Invoer
- Een domein
- Draait op
- Rovemark-server
- Kosten
- Gratis, zonder registratie
Een index geschreven voor een lezer die nooit een browser opent
Wanneer een assistent je site moet begrijpen, begint hij bij de ruwe HTML: menu, banner, footer, script. De inhoud staat daar, gemengd met al het andere. llms.txt is het alternatief, een Markdown-bestand in de rootmap, met de naam van de site, één regel over wat die is en de lijst met belangrijke pagina's, gegroepeerd per sectie.
Het voorstel dateert van september 2024, van Jeremy Howard, en wordt vooral overgenomen door documentatie- en productsites. Het is geen officiële standaard en geen enkel model is verplicht het te lezen. De kosten van publiceren zijn één statisch bestand; de winst is dat je de beslissing over wat ertoe doet niet langer aan de parser overlaat.
- 01
De tool vindt je sitemap
Hij leest robots.txt op zoek naar de Sitemap-richtlijn en probeert anders de standaardpaden. Een sitemap-index wordt gevolgd tot in de subbestanden.
- 02
Pagina’s worden per sectie gegroepeerd
Het eerste segment van de URL wordt een sectie, dat is de hiërarchie die de site zelf al heeft aangegeven. De pagina's die dichter bij de root staan komen eerst, en elke sectie krijgt een limiet, zodat geen enkele het hele bestand inneemt.
- 03
Je kopieert het en publiceert het in de root
Het bestand komt kant-en-klaar in Markdown. Publiceer het als /llms.txt in de root van het domein, net als robots.txt.
- 01
Wat is llms.txt?
- Een Markdown-bestand op /llms.txt dat de site beschrijft voor taalmodellen: titel, één regel samenvatting en links naar de belangrijkste pagina’s, gegroepeerd per sectie. Het idee is de kaart kant-en-klaar aanreiken in plaats van het model die uit de HTML te laten afleiden.
- 02
Is het hetzelfde als sitemap.xml?
- Nee. De sitemap somt URLs op voor de crawler van de zoekmachine, machine die met machine praat, zonder context. llms.txt is geschreven om gelezen te worden: het bevat naam, beschrijving en groepering, en past in een contextvenster. Het een vervangt het ander niet.
- 03
Lezen modellen dit bestand echt?
- Er is geen garantie, en het is eerlijk om dat te zeggen: geen enkele grote aanbieder heeft bevestigd llms.txt in productie te gebruiken. Wat er wel is: groeiende adoptie aan de kant van de sites en publicatiekosten van vrijwel nul. Een goedkope gok, geen zekerheid.
- 04
Waar publiceer ik het bestand?
- In de root van het domein, als /llms.txt, geserveerd als text/plain of text/markdown. Is je site statisch, dan volstaat de publieke map. Sommige projecten publiceren daarnaast een /llms-full.txt met de volledige inhoud, niet alleen de links.
- 05
Mijn site heeft meerdere talen. Wordt het bestand enorm?
- De tool verdeelt het quotum over de secties, zodat elke taal met een vergelijkbaar aantal pagina’s verschijnt in plaats van dat één taal het hele bestand opslokt. Wil je liever één bestand per taal, genereer het dan en knip de gewenste sectie eruit.
- 06
Moet ik het bijwerken bij elke nieuwe pagina?
- Ja, net als de sitemap. Het bestand is een momentopname van de site op het moment van genereren. Publiceer je vaak, genereer het dan in de build in plaats van met de hand.
Het bestand staat online. Is het antwoord veranderd?
llms.txt verbetert wat het model leest. Meten wat het over je merk antwoordt, in verschillende assistenten en door de tijd heen, is ander werk, en dat doet het platform.
