llms.txt: wat het bestand kan en of het loont

De llms.txt is een voorstel, geen standaard met gegarandeerd effect. Het kost ongeveer een uur, schaadt niet, en het grootste nut ligt mogelijk ergens anders dan de naam doet vermoeden.

Een kleine, nauwkeurig gevouwen lichtgevende vorm bij de ingang van een donkere structuur wijst de weg naar binnen

Het belangrijkste kort

  • De llms.txt is een Markdown-bestand in de hoofdmap dat een taalmodel in een paar regels vertelt waar het op de website over gaat en welke pagina's de belangrijkste zijn.
  • Het is een voorstel uit de gemeenschap, geen bindende standaard – een gegarandeerde verwerking door de grote aanbieders bestaat niet.
  • De inspanning bedraagt ongeveer een uur. Schaden kan het niet, en het neveneffect is vaak waardevoller dan het bestand zelf.
  • Het vervangt noch robots.txt noch sitemap.xml – de drie bestanden beantwoorden verschillende vragen.

Wat erin staat

Een llms.txt staat onder /llms.txt en is in Markdown geschreven – dus leesbaar voor mensen en voor modellen. Doorgaans bevat het:

  • Een kop met de naam van het bedrijf of project
  • Eén of twee zinnen waar het over gaat
  • Een becommentarieerde lijst van de belangrijkste pagina's, gegroepeerd per gebied
  • Optioneel een blok met minder belangrijke pagina's
Voorbeeld llms.txt
# Voorbeeld BV

> Wij bouwen marketingprocessen voor dienstverleners onder eigen
> leiding met 5 tot 30 mensen. Gevestigd in Zürich, opgericht in 2021.

## Basis

- [Wat we aanbieden](https://example.com/diensten/): omvang,
  verloop en prijsbereik van onze diensten
- [Over ons](https://example.com/over-ons/): oprichting, team,
  vestiging
- [Prijzen](https://example.com/prijzen/): bereiken en waarvan ze
  afhangen

## Vakbijdragen

- [Marketing opbouwen zonder team](https://example.com/blog/opbouw/):
  stappenplan voor de eerste 90 dagen
- [Wat automatisering kost](https://example.com/blog/kosten/):
  vier kostenniveaus met rekenvoorbeeld

## Optioneel

- [Colofon](https://example.com/colofon/)
- [Privacy](https://example.com/privacy/)

Het verschil met robots.txt en sitemap.xml

BestandBeantwoordtVoor wieVerbindendheid
robots.txtWat mag er gelezen worden?alle crawlersgevestigde standaard
sitemap.xmlWelke pagina's zijn er?zoekmachinesgevestigde standaard
llms.txtWat is belangrijk en waar gaat het over?taalmodellenvoorstel, wisselend ondersteund

De derde regel is het beslissende punt: een sitemap.xml somt alles op, maar weegt niet. Een llms.txt weegt en legt uit – dat is het eigenlijke verschil en de reden dat het voorstel bestaat.

Let op Er is geen openbare toezegging van de grote aanbieders om llms.txt te verwerken. Wie effect belooft, kan dat niet onderbouwen. Het bestand aanleggen is een weddenschap met een lage inzet, geen maatregel met een verwachtbaar resultaat.

Wist je dat?

Het waardevolste aan een llms.txt ontstaat bij het schrijven, niet bij het uitleveren. Om het te maken moet je beslissen: welke tien pagina's zijn werkelijk de belangrijkste? En hoe beschrijf je in één zin waar elke pagina over gaat?

Die twee vragen beantwoorden legt geregeld bloot dat een belangrijke pagina ontbreekt, dat twee pagina's hetzelfde zeggen, of dat het eigen zwaartepunt zich niet in één zin laat benoemen. Die inzichten zijn nuttig los van de vraag of het bestand ooit wordt verwerkt.

Loont de inspanning?

Ja, als …

… jullie toch al een overzicht van jullie belangrijkste pagina's nodig hebben, als jullie website veel pagina's heeft en het zwaartepunt niet in één oogopslag herkenbaar is, of als jullie documentatie aanbieden die machinaal gelezen moet worden.

Nee, als …

… jullie website twaalf pagina's heeft en het zwaartepunt voor de hand ligt. Dan levert het bestand geen informatie die niet sowieso in twee klikken zichtbaar zou zijn.

Pas daarna, als …

… de basis ontbreekt: leesbare HTML zonder afhankelijkheid van JavaScript, nette koppen, korte samenvattingen, gestructureerde data. Die werken zeker, de llms.txt misschien.

Het neveneffect

De lijst van de tien belangrijkste pagina's met per pagina één zin is tegelijk een goede basis voor de interne links en voor het inwerken van nieuwe medewerkers.

Uit de praktijk

Bij het maken valt vrijwel altijd hetzelfde op: de pagina die het moeilijkst in één zin te beschrijven is, is meestal de pagina die herzien hoort te worden. Als je niet kunt zeggen welke vraag een pagina beantwoordt, beantwoordt ze er vermoedelijk geen.

Daarom is het uur voor de llms.txt ook goed besteed als geen enkele machine het leest. Het is een inventarisatie in bestandsvorm.

Aanleggen in vier stappen

  1. De tien belangrijkste pagina's vastleggen. Belangrijk betekent: ze beantwoorden de vaakst gestelde vragen van jullie doelgroep – niet: ze hebben het meeste verkeer.
  2. Per pagina één zin schrijven die zegt welke vraag ze beantwoordt. Herhaal niet de titel.
  3. Groeperen per gebied en een blok „Optioneel“ aanleggen voor juridische en minder belangrijke pagina's.
  4. Uitleveren als /llms.txt, met het inhoudstype text/plain of text/markdown, en bij de volgende verbouwing van de website meteen bijwerken.
Prompt
Help me een llms.txt voor onze website te maken.

Onze gegevens:
- Bedrijf en vestiging: [aanduiding]
- Wat we aanbieden, voor wie: [beschrijving]
- Onze pagina's (adres, titel, waar het over gaat):
  [lijst invoegen]

Opdrachten:
1. Kies de hoogstens tien belangrijkste pagina's – belangrijk
   betekent: ze beantwoorden de vaakst gestelde vragen van onze
   doelgroep. Onderbouw de keuze kort.
2. Schrijf per pagina één zin die zegt welke vraag ze
   beantwoordt. Herhaal niet de titel.
3. Noem me de pagina's uit mijn lijst waarbij je dat niet
   lukt – die horen vermoedelijk herzien te worden.
4. Noem pagina's die inhoudelijk hetzelfde afdekken.
5. Geef de kant-en-klare llms.txt in Markdown weer, met een blok
   "Optioneel" voor juridische pagina's.

Verzin geen pagina's en geen adressen.

Conclusie

De llms.txt is een weddenschap met een lage inzet: een uur werk, geen risico, onzeker effect. Wie de basis op orde heeft, kan het meenemen; wie die nog voor zich heeft, zou daar moeten beginnen.

Het zekere deel van het nut zit in het maken: tien pagina's benoemen en er telkens één zin bij schrijven is een inventarisatie die geregeld gaten en dubbelingen blootlegt – los van de vraag of het bestand ooit wordt gelezen.

Veelgestelde vragen

Wat is llms.txt?

Een Markdown-bestand onder /llms.txt dat een taalmodel in een paar regels vertelt waar het op een website over gaat en welke pagina's de belangrijkste zijn – met per pagina één toelichtende zin. Het is een voorstel uit de gemeenschap, geen bindende standaard.

Wordt llms.txt werkelijk verwerkt?

Er is geen openbare toezegging van de grote aanbieders om het bestand te verwerken. Wie effect belooft, kan dat niet onderbouwen. Het bestand aanleggen is daarom een weddenschap met een lage inzet – een uur werk, geen risico, onzeker effect.

Wat is het verschil met de sitemap.xml?

Een sitemap.xml somt alle pagina's op, maar weegt ze niet en legt niets uit. Een llms.txt noemt alleen de belangrijkste en beschrijft per pagina in één zin welke vraag ze beantwoordt. De robots.txt regelt op zijn beurt wat er überhaupt gelezen mag worden – drie bestanden, drie verschillende vragen.

Voor wie loont een llms.txt?

Voor websites met veel pagina's waarvan het zwaartepunt niet in één oogopslag herkenbaar is, en voor aanbieders van machinaal leesbare documentatie. Bij een website met twaalf pagina's en een voor de hand liggend zwaartepunt levert het geen informatie die niet sowieso in twee klikken zichtbaar zou zijn.

Wat levert het op los van de verwerking?

Het maken zelf. Tien pagina's als de belangrijkste benoemen en er telkens één zin bij schrijven, legt geregeld bloot dat een belangrijke pagina ontbreekt, dat er twee hetzelfde zeggen, of dat een pagina zich niet in één zin laat beschrijven – die laatste hoort meestal herzien te worden.

Marketing die zichzelf opzet

De bèta van de Studio Engine is open. Reserveer je plek en denk vanaf het begin mee.

Deelnemen aan de bèta →
← Terug naar het overzicht