Checklist: is jouw website vindbaar in AI-zoekmachines?

Een praktische zelftest om te zien of ChatGPT, Perplexity en Google AI Overviews jouw website kunnen lezen: van crawlertoegang tot schema-opmaak.

Nathan de Graaf ·

In het kort

Controleer eerst of je robots.txt de AI-crawlers van ChatGPT, Claude en Perplexity toelaat: zonder die toegang kan geen enkel model je content lezen, wat er verder ook op de pagina staat. Staat dat goed, dan tellen statische HTML, schema-opmaak en content die een vraag meteen beantwoordt het zwaarst mee. Deze checklist loopt de belangrijkste controles langs, met per punt hoe je het zelf natrekt.

Kan een AI-crawler jouw site wel binnenkomen?

Typ jouwdomein.nl/robots.txt in de browser en zoek naar een Disallow-regel die een AI-crawler blokkeert. De relevante namen zijn intussen breder dan de bekende GPTBot en ClaudeBot: reken ook OAI-SearchBot, ChatGPT-User, PerplexityBot, Google-Extended en Bingbot mee. Staat er nergens een expliciete Disallow voor deze user-agents, dan is deze eerste horde genomen.

Sommige sites blokkeren zulke bots zonder dat iemand dat doorheeft, via een te strikte instelling in het CMS of een beveiligingsplugin die alle onbekende crawlers weert. Dat merk je als eigenaar niet: de site werkt gewoon voor bezoekers, alleen de crawler krijgt nul toegang en dus kan geen enkel model citeren wat er op de pagina staat.

Staat de content al in de HTML, of bouwt de browser hem pas?

Klik met de rechtermuisknop op je pagina en kies 'pagina broncode bekijken' (of gebruik Ctrl+U). Zoek naar een stuk tekst dat je net op de pagina zag. Staat het daar letterlijk tussen de HTML, dan lees je de site zoals een AI-crawler dat ook doet. Zie je vooral een leeg canvas met wat scriptverwijzingen, dan verschijnt de content pas nadat er iets is uitgevoerd in de browser, en dat slaan de meeste AI-crawlers over: ze halen alleen de ruwe HTML-respons op.

Waarom dat verschil bestaat en wat het technisch betekent voor hoe je bouwt, staat uitgebreider in ons artikel over AI-crawlers en statische HTML. Voor deze checklist volstaat het antwoord op één vraag: staat de tekst in de broncode, ja of nee?

Legt schema-opmaak uit wie je bent en wat je aanbiedt?

Zoek in dezelfde broncode naar `application/ld+json`. Vind je dat, dan geeft je site machineleesbare feiten mee: bedrijfsnaam, adres, aanbod, en bij een dienst- of kennisbankpagina idealiter ook de vragen die er beantwoord worden. Ontbreekt dat blok, dan moet een AI-model zelf uit lopende tekst afleiden wie je bent, en die afleiding gaat vaker mis dan je zou verwachten.

Bij FAQ-schema specifiek geldt een nuance: Google toont het uitklapbare vraag-antwoordblok sinds mei 2026 niet meer in de zoekresultaten. Het schema blijft geldig en Google gebruikt de data naar eigen zeggen nog om content te begrijpen; bij Bing verschijnt het rich result nog gewoon, en voor een AI-assistent die vraag-antwoordstructuur herkent telt het ook mee. De directe klik in Google is dus weg, de rest van het nut niet.

Heb je een llms.txt, en moet dat ook?

Een llms.txt is een kort tekstbestand op je root (jouwdomein.nl/llms.txt) met een beknopt overzicht van je belangrijkste pagina's, bedoeld als snelle ingang voor AI-modellen. De standaard wint terrein, maar de grote AI-crawlers halen het bestand zelf nog nauwelijks actief op. Zie het daarom als goedkope hygiëne, een half uur werk dat weinig kwaad kan, en niet als vervanging voor de rest van deze lijst.

Beantwoordt de pagina de vraag meteen, of moet een lezer eerst scrollen?

Lees de eerste alinea onder je kop los van de rest van de pagina. Staat het antwoord op de titelvraag daar al, in gewone taal, zonder eerst een stuk bedrijfsgeschiedenis of een lange inleiding? Dan citeert een AI-model die passage relatief makkelijk, want dat is letterlijk hoe deze modellen tekst extraheren uit een pagina.

Koppen die als vraag zijn geformuleerd ("wat kost een website laten bouwen?" in plaats van "onze prijzen") helpen daarbij: ze sluiten aan op hoe iemand een vraag aan een AI-assistent stelt, en een model herkent die overeenkomst.

← Terug naar de kennisbank

Veelgestelde vragen

Crawlertoegang en statische content wegen het zwaarst: zonder die twee kan een model je sowieso niet lezen. Schema, llms.txt en antwoord-eerst content bouwen daarna voort op wat er al staat.

Onze GEO-aanpak begint met precies deze controle, alleen geautomatiseerd en met een concreet advies per punt in plaats van een handmatige zoektocht in de broncode.

Dit is een momentopname per september 2026. Crawlernamen komen erbij, en Google paste dit jaar al eens de FAQ-weergave aan, dus het is verstandig deze lijst periodiek opnieuw langs te lopen in plaats van hem één keer af te vinken.

Grotendeels ook voor Google: statische content, schema en antwoord-eerst schrijven zijn evengoed SEO-fundament. Alleen de llms.txt-controle is echt AI-specifiek.

Contact

Klaar om beter gevonden te worden?

Plan een vrijblijvend gesprek. We kijken samen waar de kansen liggen om je beter vindbaar te maken, in AI en in Google.

We reageren gewoonlijk binnen één werkdag

Stuur een bericht

We lezen elk bericht persoonlijk en reageren zo snel mogelijk.

Beveiligd met reCAPTCHA. Privacy & Voorwaarden.