home / kennisbank / vindbaar in ai
kennisbank

Vindbaar worden in ChatGPT en Perplexity: wat je technisch nodig hebt_

Steeds meer mensen krijgen antwoord zonder ooit op een zoekresultaat te klikken. Zichtbaar zijn betekent daardoor: genoemd worden in het antwoord zelf. De meeste artikelen daarover gaan over schrijfstijl. In de praktijk gaat het vooral over techniek, en dus over de vraag of je zelf bij je eigen site kunt.

de_kern

Waarom dit nu speelt en niet volgend jaar

Gartner verwacht dat het zoekvolume via klassieke zoekmachines dit jaar met een kwart daalt en dat het organische zoekverkeer met meer dan de helft terugloopt. Voorspellingen, met alle onzekerheid die daarbij hoort. Maar de markt stelt zich er zichtbaar op in.

Google rapporteert sinds 3 juni 2026 in Search Console apart over generatieve AI-features: je ziet daar hoe vaak je pagina's in een AI-antwoord verschijnen. De uitrol begon bij een deel van de Britse sites en gaat wereldwijd, zonder datum. Voorlopig zie je alleen vertoningen, geen klikken, posities of zoektermen. Tegelijk kreeg je per 17 juni 2026 een knop om je content juist volledig uit die AI-features te houden.

Dat is het echte nieuws: niet dat AI-zoeken bestaat, maar dat het meetbaar wordt en dat er keuzes aan hangen. Meetbaarheid is meestal het moment waarop een hype een vak wordt.

En wat er dan te doen valt is zelden een lijstje schrijftips. Vrijwel alles wat bepaalt of jij in een AI-antwoord belandt zit in de techniek van je site: in bestanden, headers en instellingen. Vijf lagen, van onder naar boven.

laag_01

Een AI-crawler moet er om te beginnen bij kunnen

Voordat er iets te citeren valt, moet een crawler je pagina kunnen ophalen. In je robots.txt staat wie dat mag. De namen die ertoe doen: GPTBot, ClaudeBot, PerplexityBot en Google-Extended. Die laatste bepaalt of Google je content in AI-antwoorden mag gebruiken, los van je gewone zoekresultaten.

In de praktijk staan die crawlers verrassend vaak op blokkeren, zonder dat iemand daar bewust voor koos: een securityplugin die "bots" tegenhoudt, een firewallregel bij de host, een standaardinstelling die ooit is aangezet. Cloudflare weert vanaf 15 september 2026 mixed-use crawlers standaard van pagina's met advertenties, bij nieuwe klanten en alle gratis accounts. Zonder advertenties raakt dat jou waarschijnlijk niet. Het punt is waar de knop zit: bij je hosting, niet in je tekstverwerker. De eerlijke vraag is dus niet of je AI-crawlers toelaat, maar of je weet wie jouw robots.txt en firewallregels beheert.

laag_02

Bing weegt zwaarder dan je verwacht

Verreweg het meeste verkeer dat vanuit AI-assistenten naar websites komt, komt van ChatGPT: schattingen leggen dat aandeel rond de 78 procent. En ChatGPT leunt voor zijn webresultaten op de index van Bing. Jarenlang was Bing de zoekmachine die je kon negeren, en precies die bepaalt nu je zichtbaarheid in het grootste AI-kanaal.

Praktisch: meld je site aan in Bing Webmaster Tools en controleer of je pagina's daar echt in de index staan. Zet daarnaast IndexNow aan, het protocol waarmee je Bing bij publicatie meteen een seintje geeft in plaats van te wachten op een crawler. Dat vraagt een sleutelbestand in de hoofdmap van je site en een aanroep bij elke publicatie.

Op een site in eigen beheer is dat een regel in je publicatieproces. Op een site die je niet zelf beheert is het een verzoek aan iemand anders.

laag_03

Je tekst moet in de broncode staan, niet erin geladen worden

Veel AI-crawlers voeren geen of maar beperkt JavaScript uit. Verschijnt je tekst pas nadat een script hem heeft opgehaald, dan ziet zo'n crawler een lege pagina. Google is hier vergevingsgezinder dan de rest, en dat maakt het verraderlijk: je staat netjes in Google en toch nergens in AI-antwoorden.

Je test het in tien seconden: klik met rechts, kies "paginabron weergeven" en zoek er een letterlijke zin uit je eigen tekst in terug. Vind je hem niet, dan vindt een AI-crawler hem waarschijnlijk ook niet. Zware page builders zijn hier de vaste boosdoener.

laag_04

Structuur waar een machine iets mee kan

Een taalmodel citeert het liefst wat het zonder interpretatie kan overnemen. Dat betekent gestructureerde data via schema.org: Organization voor je bedrijf, Article voor je artikelen, FAQPage voor veelgestelde vragen. Het is machineleesbare uitleg van wat er op de pagina staat.

Daarnaast helpt de vorm van je tekst. Zet de vraag in de kop en het antwoord in de eerste zin eronder. Schrijf definities voluit: "een datalaag in eigen beheer is ..." is citeerbaar, "hier zijn de voordelen" niet. Noem getallen, datums en bronnen, want die zijn controleerbaar en worden vaker overgenomen. Een garantie levert dit niet op: er is geen ranking die je kunt kopen en geen trucje dat je in het antwoord duwt. Je maakt je pagina alleen zo makkelijk mogelijk om te gebruiken.

laag_05

llms.txt: doen, maar verwacht er weinig van

Er is een voorgestelde standaard, llms.txt: een bestandje in de hoofdmap waarin je taalmodellen een samenvatting en een wegwijzer geeft. Eerlijk beeld: de adoptie zit rond de twee procent van de sites en geen enkele grote AI-aanbieder heeft officieel toegezegd het ook echt te gebruiken. Het kost een half uur en kan geen kwaad, dus wij zetten het neer. Maar wie het je verkoopt als dé oplossing voor AI-vindbaarheid, verkoopt je lucht. De vier lagen hierboven doen het werk.

de_toets

Vier dingen die je vanmiddag zelf kunt controleren

Open jouwdomein.nl/robots.txt en kijk of GPTBot, PerplexityBot of Google-Extended op disallow staan. Bekijk daarna de paginabron van je belangrijkste pagina en zoek er een eigen zin in terug. Zoek vervolgens site:jouwdomein.nl op in Bing en tel je pagina's. En vraag ten slotte aan ChatGPT en Perplexity wie ze aanraden voor jouw dienst in jouw regio, en kijk wie er dan wel genoemd wordt.

Valt een van de vier tegen, dan is de vraag zelden wat er moet veranderen. Dat is meestal binnen een uur duidelijk. De vraag is wie het doet en hoe lang je erop wacht.

en_nu

Uiteindelijk is dit een eigendomsvraag

Kijk terug naar de vijf lagen: een bestand in de hoofdmap, een firewallregel, een sleutel voor IndexNow, gestructureerde data in de broncode, HTML die zonder JavaScript leesbaar is. Geen enkel punt is een tekst die je in een editor typt. Het zijn allemaal ingrepen op de site zelf.

Zit je website achter een stapel plugins of bij een bureau dat de sleutels heeft, dan is elk van die vijf lagen een ticket, een wachtrij en een factuur. Te overzien als het één keer hoeft. Maar de spelregels veranderen elk kwartaal: nieuwe crawlernamen, nieuwe rapportages, nieuwe standaarden die het misschien wel of niet worden. De vraag is dus niet of je een keer kunt aanpassen, maar of je kunt blijven aanpassen.

Daarom pleiten wij voor een site in eigen beheer: eigen code, eigen hosting, niets tussen jou en je robots.txt. Hoe die overstap eruitziet staat op de pagina van WordPress naar eigen beheer. Het is dezelfde afhankelijkheid als bij je bedrijfssoftware, en daar schuift de wet inmiddels in jouw voordeel op: zie Data Act: vanaf 2027 mag overstappen niets kosten.

Verder lezen: de whitepaper

In de whitepaper over de overstap naar eigen beheer lees je wat de verborgen rekening van je huidige site is en hoe de overstap in één week verloopt.

Download de whitepaper