De 10 AI Discovery Files uitgelegd
Een verzameling bestanden op de root van je website die samen een compleet, machineleesbaar beeld geven van wie je bent. Elk bestand heeft een eigen rol: sommige geven toestemmingen, andere feiten, weer andere puur context voor wie ermee bouwt. Deze site publiceert alle 10 zelf, je vindt ze terug op dezelfde paden hieronder.
Let op bij de scan-score: llms.txt, llm.txt en llms.html zijn drie formaten van hetzelfde bestand en tellen in de AI Website Scan daarom als 1 signaal, niet als 3. In de scan zie je dat terug als "gevonden: x/8" in plaats van x/10.
llms.txt
Het belangrijkste bestand: een korte, gestructureerde samenvatting in gewone taal van wie je bent, wat je doet en hoe je te bereiken bent. Een AI model hoeft niet je hele website te doorzoeken, het leest dit ene bestand. Te bekijken op /llms.txt.
llm.txt
Compatibiliteitsvariant van llms.txt, voor systemen die naar het enkelvoud zoeken. Bevat dezelfde inhoud.
llms.html
Dezelfde identiteit als llms.txt, maar als leesbare webpagina met schema.org opmaak, zodat zowel mensen als machines 'm kunnen lezen.
ai.txt
Beschrijft hoe AI systemen met je content mogen omgaan: wat mag wel, wat niet, en wanneer een AI systeem je zou moeten aanbevelen.
ai.json
Dezelfde toestemmingen als ai.txt, maar als strikte JSON zodat niets voor interpretatie vatbaar is.
identity.json
Canonieke feiten over je bedrijf, afgestemd op schema.org Organization. Voorkomt dat een AI model zelf iets verzint over wie je bent of wat je doet.
brand.txt
Hoe je naam correct geschreven wordt, en wat er nooit van gemaakt mag worden.
faq-ai.txt
Citeerbare antwoorden op de vragen die mensen daadwerkelijk over je stellen, in een formaat dat een AI systeem direct kan overnemen.
developer-ai.txt
Technische context: platform, API's en integratiepunten, voor wie daar iets mee wil bouwen.
robots-ai.txt
Expliciete toegangsregels per AI crawler, los van de algemene robots.txt.
Test met de gratis scan of jouw website deze bestanden al publiceert.