Kort antwoord: misschien, zonder dat je het weet. Uit een onderzoek onder de 500 populairste Nederlandse websites blijkt dat ongeveer 1 op de 5 de crawlers van ChatGPT, Gemini en Perplexity buitensluit, meestal via een standaardinstelling in het robots.txt-bestand. Sta je op blokkeren, dan kun je niet worden geciteerd. Het is in vijf minuten te controleren.
Steeds meer klanten stellen hun vraag aan ChatGPT of Perplexity in plaats van aan Google. Die tools sturen hun eigen bots langs om te lezen wat er op websites staat. Leest zo'n bot jouw site niet, dan kun je ook niet in het antwoord terechtkomen. En juist daar loopt het vaak mis: Frankwatching scande in juli 2026 de vijfhonderd populairste Nederlandse websites en vond dat ongeveer een op de vijf de AI-crawlers blokkeert. Bijna altijd niet uit principe, maar omdat een plugin of een standaardinstelling in het systeem dat stilletjes doet. De eigenaar weet van niets.
Op vrijwel elke site staat een klein bestand met de naam robots.txt. Dat vertelt bots wat ze wel en niet mogen lezen. Naast de bekende Google-bot hebben de AI-tools inmiddels hun eigen namen: GPTBot en OAI-SearchBot van OpenAI, ClaudeBot van Anthropic, PerplexityBot van Perplexity en Google-Extended voor Gemini. Staat achter zo'n naam het woord Disallow, dan houd je die tool buiten de deur. Sommige CMS-systemen en privacy- of SEO-plugins zetten zo'n blokkade standaard aan, in de veronderstelling dat ze je beschermen. Het gevolg is dat je onzichtbaar bent voor precies de zoekmachines waar je klant nu zit.
Typ je eigen domein in de adresbalk met /robots.txt erachter, bijvoorbeeld jouwbedrijf.nl/robots.txt. Zoek in de tekst naar de namen hierboven. Zie je daar een Disallow bij staan, dan blokkeer je die crawler. Zie je niets over die namen, dan zijn ze in principe welkom. Een tweede plek om te kijken is de broncode van je pagina's: een tag met noindex of een robots-instelling die AI uitsluit doet hetzelfde werk, alleen per pagina. Kom je er niet uit, dan is dit precies wat de AI APK voor je nakijkt, samen met de vraag of je daadwerkelijk genoemd wordt.
Toelaten is voor de meeste mkb-bedrijven de logische keuze. Een AI-crawler leest alleen je openbare pagina's, net zoals Google dat al jaren doet, en je geeft er geen rechten mee weg. Wil je toch iets afschermen, bijvoorbeeld een besloten klantomgeving of prijslijsten die niet openbaar horen te zijn, blokkeer dan gericht die pagina's en laat de rest open. De fout die je wilt voorkomen is de onbewuste: de hele site dicht, zonder dat iemand die knop ooit bewust heeft omgezet. Zichtbaar zijn is stap een. Daarna komt de echte vraag, namelijk of die tools je ook echt noemen. Hoe je die bron wordt, lees je in hoe word je vindbaar in ChatGPT en AI-zoekers? En wat dat oplevert, staat in wat levert AI een mkb-bedrijf echt op?
Typ je eigen domein in met /robots.txt erachter, bijvoorbeeld jouwbedrijf.nl/robots.txt. Zie je regels met Disallow onder namen als GPTBot, ClaudeBot, PerplexityBot of Google-Extended, dan sluit je die AI-crawlers buiten. Staat er niets over die namen, dan zijn ze in principe welkom.
De belangrijkste zijn GPTBot en OAI-SearchBot van OpenAI (ChatGPT), ClaudeBot van Anthropic, PerplexityBot van Perplexity en Google-Extended van Google. Die lijst verandert, dus controleer hem af en toe. Blokkeer je er een, dan kan die tool je niet citeren.
Nee. Een crawler leest je openbare pagina's, net als Google al jaren doet. Je geeft geen rechten weg en je content blijft van jou. Wil je bepaalde pagina's afschermen, blokkeer dan gericht die pagina's en laat de rest open.
Bronnen: Frankwatching: 1 op de 5 Nederlandse websites blokkeert AI-zoekmachines (6 juli 2026) · Frankwatching: 83% van het mkb is onzichtbaar voor AI (22 juni 2026)
Een uur sparring is gratis. Daarna weet je waar je staat.