llms.txt: moet je dit bestand op je website hebben?

Kort antwoord

llms.txt is een tekstbestand in de root van een website dat AI-systemen een geordend overzicht van de belangrijkste pagina's geeft. Het is een voorstel uit september 2024 en geen vastgestelde standaard. Je hebt het niet nodig: 97% van alle llms.txt-bestanden krijgt nul verzoeken, gemeten over 137.210 domeinen.

OnderwerpVindbaarheid
Bijgewerkt10 augustus 2026
Gecontroleerd doorOlaf van Gastel

Dit zijn de vier mensen die je werk doen. Geen accountlaag tussen jou en de uitvoering: je hebt één vast aanspreekpunt in Eindhoven en onder elk maandrapport staat de naam van de maker. Maak kennis met het team

4,8uit 125 reviews op Trustpilot

Wat is llms.txt, en waar komt het voorstel vandaan?

llms.txt is een markdownbestand op /llms.txt dat een taalmodel in één oogopslag laat zien waar de bruikbare inhoud van een site staat. Het bevat een korte beschrijving van de site en daarna een lijst met links naar de belangrijkste pagina's.

Het voorstel voor het llms.txt-bestand is van Jeremy Howard en is gepubliceerd op 3 september 2024. De reden die erin staat is technisch: het contextvenster van een taalmodel is te klein voor een hele website, en HTML met navigatie, advertenties en JavaScript omzetten naar bruikbare platte tekst is lastig en onnauwkeurig.

Het voorstel gaat verder dan één bestand. Het adviseert ook om van elke nuttige pagina een schone markdownversie aan te bieden op dezelfde URL met .md erachter. Het oorspronkelijke voorbeeld is een softwareproject dat zijn documentatie zo aanbiedt, zodat een model tijdens het programmeren de juiste handleiding kan lezen.

Dat is de context die zelden wordt meegeleverd. Het voorstel is bedacht voor documentatie die een model tijdens het werk moet raadplegen, niet als vindbaarheidsmiddel voor een bedrijfswebsite. Een vastgestelde standaard is het niet: er is geen werkgroep, geen versienummer en geen partij die naleving controleert.

Wil je weten hoe dit voor jouw site uitpakt? We kijken er gratis naar.

Wat zegt Google erover?

Google zegt letterlijk dat het niet nodig is. In de documentatie over AI-functies en je website staat dat je geen nieuwe machineleesbare bestanden, geen AI-tekstbestanden en geen markup hoeft te maken om in die functies te verschijnen, en dat er ook geen speciale schema.org-opmaak voor bestaat.

Dezelfde pagina noemt wat er wel toe doet: crawlen toestaan in robots.txt en bij je hostingpartij, belangrijke inhoud in tekstvorm aanbieden, en je gestructureerde data laten overeenkomen met de zichtbare tekst. De partij die het antwoord samenstelt, zegt dus dat je dit bestand er niet voor nodig hebt.

Wat gebeurt er met zo'n bestand in de praktijk?

Meestal niets. Van alle onderzochte llms.txt-bestanden krijgt 97% nul verzoeken, gemeten over 137.210 domeinen. Het bestand staat er, en er komt nooit iemand langs.

Dat is de reden dat wij dit artikel schrijven. Wij hadden zelf een llms.txt-bestand op brightbrands.online staan, en toen we het openden was het dit:

Omvang

261 KB en 1.401 regels, waar een leesbaar overzicht van een site van deze omvang op een paar KB past.

Inhoud

84% van de inhoud was geen overzicht met links, maar een letterlijke tekstkopie van hele pagina's.

Structuur

Twee H1's in één bestand, dus twee keer een hoofdtitel voor één site.

Leesbaarheid

37 entiteiten stonden onvertaald in de tekst, dus als codes en niet als leestekens.

Links

27 links wezen naar http in plaats van naar https.

Positionering

De positionering die erin stond, was verouderd en beschreef het bedrijf niet meer.

Wat werkt er dan wel?

Je tekst leesbaar maken voor een crawler die geen browser is. AI-crawlers voeren geen JavaScript uit, en dat geldt voor GPTBot, ClaudeBot en PerplexityBot. Staat je tekst pas in de pagina nadat JavaScript hem heeft opgebouwd, dan ziet zo'n crawler een lege pagina.

Daar helpt geen bestand tegen. Daar helpt het opbouwen van de pagina aan de serverkant: de tekst staat in de HTML die de server verstuurt, voordat er één script draait. Dat is een bouwkeuze, en de plek om hem te maken is bij het laten maken van je website en niet in een bijlage erna.

Praktisch: zet het antwoord op een echte klantvraag bovenaan de pagina, zet er een cijfer met bron en datum bij, noem je bronnen bij naam, en controleer of die tekst in de HTML staat.

Dit artikel hoort bij onze dienst GEO-optimalisatie.

Wanneer heeft een llms.txt-bestand wel zin?

Bij technische documentatie die een model tijdens het werk moet raadplegen. Dat is de situatie waarvoor het voorstel is geschreven, en daar doet het iets: een ontwikkelaar richt zijn hulpmiddel op jouw /llms.txt en het model haalt daar de juiste handleiding op.

Verkoop je software met een API of een pluginbibliotheek, dan is dat een reëel scenario. Verkoop je installatiewerk, catering of juridisch advies, dan raadpleegt niemand jouw documentatie tijdens het programmeren.

Kort samengevat

Kort samengevat

llms.txt is een voorstel uit september 2024, geen vastgestelde standaard, en 97% van alle bestanden krijgt nul verzoeken over 137.210 domeinen. Google schrijft zelf dat je geen nieuwe machineleesbare bestanden nodig hebt om in AI-functies te verschijnen. Wat wel meetbaar helpt: je tekst in de HTML zetten, zodat AI-crawlers hem kunnen lezen zonder JavaScript uit te voeren.

Meer vragen hierover

Wat staat er in een llms.txt-bestand?

Een korte beschrijving van de site, gevolgd door een lijst met links naar de belangrijkste pagina's, in markdown. Het voorstel adviseert ook om van elke nuttige pagina een schone markdownversie aan te bieden op dezelfde URL met .md erachter. Wat er niet in hoort, is de volledige tekst van al je pagina's.

Leest ChatGPT mijn llms.txt-bestand?

Daar is geen publieke bevestiging van door een grote AI-aanbieder. Wat wel gemeten is: 97% van alle llms.txt-bestanden krijgt nul verzoeken, over 137.210 domeinen. Wil je weten of het bij jou gebeurt, kijk dan in je serverlogboek naar verzoeken op dat pad.

Is llms.txt hetzelfde als robots.txt?

Nee, en het verschil is groot. robots.txt is een afspraak die alle grote crawlers naleven en die zegt wat wel en niet mag worden opgehaald. llms.txt is een voorstel van één auteur uit 2024 dat zegt waar de bruikbare inhoud staat. Het eerste wordt gerespecteerd, het tweede wordt zelden opgevraagd.

Schaadt een llms.txt-bestand mijn vindbaarheid?

Het bestand zelf niet. Het risico zit in veroudering: ons eigen bestand bevatte een positionering die niet meer klopte en 27 links over http, en niemand keek er ooit naar. Wordt zo'n bestand toch gelezen, dan geeft het een verkeerd beeld. Onderhoud het of haal het weg.

Hoe controleer ik of mijn llms.txt-bestand wordt opgevraagd?

In het toegangslogboek van je server. Zoek op het pad /llms.txt en filter op de bekende AI-crawlers, dus GPTBot, ClaudeBot en PerplexityBot. Zie je over een maand nul verzoeken, dan weet je dat je bestand bij de 97% hoort en kun je die tijd beter aan je pagina's besteden.

Moet ik markdownversies van al mijn pagina's aanbieden?

Dat hoeft niet, en voor een bedrijfswebsite levert het weinig op. Het advies komt uit een voorstel voor softwaredocumentatie. Zorg liever dat je gewone pagina's hun tekst in de HTML hebben staan, want daar halen zowel Google als de AI-crawlers hem op.

Volgende stap

Dit artikel hoort bij onze dienst GEO-optimalisatie. Bekijk GEO-optimalisatie

Volgende stap

Wil je weten wat Google en ChatGPT nu over je zeggen?

Je krijgt antwoord van iemand die het gebouwd heeft, niet van een helpdesk.

Bright Brands
KvK 99967782
btw NL869207878B01
040 220 24 03
Plan een gesprekDoe de gratis check