Naar de inhoud
AI & trends

AI-crawlers en llms.txt: wie mag jouw content gebruiken?

AI-crawlers van OpenAI, Anthropic en Google lezen massaal websites uit. Wat robots.txt en het nieuwe llms.txt daarover te zeggen hebben, en waarom volledig blokkeren meestal onverstandig is.

Je website wordt al jaren bezocht door zoekmachine-crawlers, maar sinds kort schuiven er nieuwe gasten aan: AI-crawlers van OpenAI, Anthropic, Google en tientallen kleinere partijen. Die lezen je content niet om je vindbaar te maken, maar om taalmodellen te trainen of om antwoorden mee te formuleren. Dat roept een vraag op waar steeds meer ondernemers over nadenken: wie mag mijn content eigenlijk gebruiken, en heb ik daar iets over te zeggen?

Welke crawlers er langskomen

Grofweg zijn er drie soorten. Trainingscrawlers (zoals GPTBot van OpenAI of ClaudeBot van Anthropic) verzamelen tekst om modellen mee te trainen. Zoekcrawlers van AI-diensten indexeren je site zodat een assistent er live antwoorden uit kan halen. En dan zijn er nog bezoeken namens één gebruiker, wanneer iemand een AI-tool vraagt een pagina te lezen. In je serverlogboeken zie je ze verschijnen onder hun eigen namen — en het verkeer is inmiddels aanzienlijk.

Wat je erover te zeggen hebt

  • Robots.txt werkt nog steeds. Nette AI-crawlers respecteren een blokkade in je robots.txt, per bot instelbaar. Je kunt dus training weigeren en zoekverkeer toestaan.
  • Llms.txt is de nieuwkomer. Dit voorgestelde bestand is geen slot op de deur, maar een leeswijzer: een beknopt overzicht in platte tekst dat AI-systemen vertelt wat je site is en welke pagina’s er echt toe doen.
  • De AI Act helpt rechthebbenden. De Europese regels verplichten modelbouwers om machineleesbare voorbehouden te respecteren; een expliciet voorbehoud op je site krijgt daarmee juridisch gewicht.
  • Blokkeren heeft een prijs. Wie alle AI-crawlers weert, verdwijnt ook uit AI-antwoorden — en dat wordt een steeds serieuzer kanaal waarlangs klanten je vinden.

Wat wij mkb-bedrijven adviseren

Voor de meeste bedrijfswebsites is zichtbaarheid meer waard dan bescherming: jouw dienstenpagina’s wíl je juist in AI-antwoorden hebben. Blokkeer wat je echt niet gedeeld wilt zien (klantportalen, gedateerde content), overweeg een llms.txt met je belangrijkste pagina’s, en kijk af en toe in je statistieken welk verkeer AI-diensten je al sturen. Verkoop je juist unieke content — cursussen, onderzoek, fotografie — dan ligt de afweging anders en is een trainingsblokkade te verdedigen.

Onze conclusie

AI-crawlers zijn niet tegen te houden met verontwaardiging, wel te sturen met een paar regels tekst. Bepaal bewust wat je deelt, in plaats van het te laten gebeuren.

Hulp nodig bij robots.txt, llms.txt of je AI-strategie? Neem gerust contact op.

Alle artikelen

Contact

Hulp nodig bij dit onderwerp?

Vul onderstaand formulier in en we nemen zo spoedig mogelijk contact met je op. Liever zelf contact opnemen? Bel dan even met 085-4015005.

    ONZE KLANTEN

    We werken voor een brede variatie aan klanten, van ZZP-er tot multinational en van reclamebureau tot eindgebruiker. Al onze klanten hebben wel iets gemeen: ze delen onze no-nonsense aanpak en maken graag stappen.

    Kop koffie doen?

    Geen moeilijke internetpraatjes, gewoon een goed gesprek met Stefan & Luc over jouw plannen. De koffie staat klaar.