Naar de inhoud
POLARGATE
geo

Hoe word je in 2026 geciteerd door ChatGPT, Claude en Perplexity

Praktische checklist voor AI-zoekzichtbaarheid in 2026: welke crawlers JavaScript draaien, robots.txt, antwoord-eerst, actualiteit en het meten van citaties.

Gepubliceerd 2026-08-12 · Door Pedro Ciordia

Een vrouw laat op de avond aan de keukentafel, kin op haar hand, turend naar een laptop naast wat papieren en een glas water, stadslichten achter het raam

Gevonden worden door een AI-assistent is in 2026 vooral een technisch probleem met een contentstaart, niet andersom. Dit is de checklist die Polargate doorloopt bij elke site die we bouwen of onderhouden, met het bewijs achter elk punt.

Bijna geen enkele AI-crawler draait JavaScript

Begin hier, want dit ene feit bepaalt al het andere. Als ChatGPT, Claude of Perplexity je pagina ophalen, lezen ze de ruwe HTML die je server teruggaf. Ze voeren je JavaScript niet uit. Vercel en MERJ maten meer dan 500 miljoen GPTBot-verzoeken en registreerden nul JavaScript-uitvoeringen. Is je site een React-schil die na hydratie een lege div vult, dan zien die machines een lege div.

Het actuele beeld, crawler voor crawler:

  • Googlebot: rendert JavaScript (evergreen Chromium). Voedt Search, AI Overviews en AI Mode.
  • Bingbot: rendert JavaScript (Edge-renderer), maar gaat slechter om met single-page apps dan Google. Voedt Bing, Copilot en een deel van de retrieval van ChatGPT.
  • Applebot: rendert JavaScript (browsergebaseerd). Voedt Siri, Spotlight en Apple Intelligence.
  • OAI-SearchBot, die de zoekindex van ChatGPT bouwt: geen JavaScript.
  • ChatGPT-User, de live fetch die afgaat zodra iemand naar je pagina vraagt: geen JavaScript.
  • GPTBot (training): geen JavaScript. Hij downloadt je .js-bestanden en voert ze nooit uit.
  • Claude-SearchBot en Claude-User: geen JavaScript.
  • ClaudeBot (training): geen JavaScript. Ongeveer 24% van zijn verzoeken zijn JS-bestanden die hij nooit draait.
  • PerplexityBot en Perplexity-User: geen JavaScript. Perplexity is van dit gezelschap het gevoeligst voor actualiteit.
  • Amazonbot, Meta-WebIndexer, Bytespider: geen gedocumenteerde rendering.
  • Agentische browsers (ChatGPT Atlas, Perplexity Comet): echte Chromium, dus die renderen wel. In april 2026 waren zij goed voor ongeveer 70% van het agentische verkeer, Comet 48% en Atlas 21%.

Het eerste punt op de lijst is dus geen metatag, maar statische HTML voor elke publieke route. Op een nieuwssite die Polargate herbouwde, kreeg de crawler eerst 14 tekens voorgeschoteld ("Redirecting...") en nu 11.421 tekens artikeltekst; het geserveerde document ging van een schil van 3.559 bytes naar een echte body. Op een hotelsite die wij onderhouden liet Search Console vóór het prerenderen slechts 4 van ongeveer 30 pagina's als geïndexeerd zien.

Controleer het zoals een crawler dat doet, niet in DevTools: haal de URL op met de user agent van de bot en zoek in het antwoord naar je H1 en je bodytekst. Staat het niet in de broncode, dan bestaat het niet.

Laat de juiste bots binnen, en controleer ook de rand

Elke aanbieder splitst inmiddels drie soorten agent: trainingscrawlers (GPTBot, ClaudeBot, Google-Extended, Applebot-Extended), zoekindexeerders (OAI-SearchBot, Claude-SearchBot, PerplexityBot, Meta-WebIndexer) en door de gebruiker aangestuurde fetchers (ChatGPT-User, Claude-User, Perplexity-User). OpenAI zegt het onomwonden: een site die OAI-SearchBot blokkeert, verschijnt niet in de zoekantwoorden van ChatGPT.

  • Sta de zoek- en antwoordagents expliciet bij naam toe in robots.txt.
  • Behandel de trainingscrawlers als een aparte zakelijke afweging. Blokkeren kost je geen citaties, maar houdt je wel uit de modelgewichten.
  • Blokkeer nooit /assets/, CSS of JS: dat breekt de rendering van Googlebot en Applebot, precies de twee die wel renderen.
  • Audit de rand. Een firewallpreset die "AI-bots" weigert, of een botcheck, geeft 403 terug aan fetchers die zo'n check niet kunnen oplossen, en dan redt geen enkele robots.txt je nog.
  • Ruim 404's op. Ongeveer 35% van de verzoeken van GPTBot en ClaudeBot komt op ontbrekende URL's uit, dus houd oude paden doorverwezen.
  • Google-Extended en Applebot-Extended zijn gebruikstokens, geen crawlers. Ze uitsluiten heeft geen effect op Search of AI Overviews.

Deze fouten falen stil. Bij een audit die Polargate op een klantsite deed, versmalde een fout in de groepsovererving van robots.txt ongemerkt welke agents toegang hadden, naast vijftien andere bevestigde bugs.

Zet het antwoord vooraan

De instant-modus van ChatGPT ziet de title, de H1 en ongeveer de eerste 200 tekens daarna. Perplexity gaat af op de eerste 100 woorden, leest zo'n tien pagina's per vraag en citeert er drie of vier. Van alle ChatGPT-citaties komt 44,2% uit de eerste 30% van een pagina. Een hero-video en een H1 die alleen een slogan is, verspillen dat budget.

De structuur die geciteerd wordt

  • Eén H1 die de entiteit en de bewering noemt, direct gevolgd door een antwoord in gewone tekst van één of twee zinnen.
  • H2's geformuleerd als de vraag die een koper intypt. Content in vraagvorm wordt ongeveer twee keer zo vaak geciteerd, 78,4% van de aan vragen gekoppelde citaties komt uit koppen, en een kop die goed op de vraag aansluit wordt in 41% van de gevallen geciteerd tegenover 29% bij een zwakke match.
  • Onder elke kop een zelfstandig antwoord van 40 tot 70 woorden, in definiërende taal ("X is", "X betekent").
  • Echte HTML-tabellen voor vergelijkingen en prijzen. Een tabel die tijdens runtime uit JSON wordt opgebouwd, of als afbeelding is geëxporteerd, draagt niets bij.
  • Concrete cijfers met eenheid en datum, toegeschreven citaten en links naar de primaire bron. Het GEO-onderzoek van Princeton en Georgia Tech over 10.000 vragen mat +41% zichtbaarheid door citaten toe te voegen, +33% door statistieken en +28% door bronvermelding, met de grootste winst voor lager gerangschikte sites.
  • Slugs in natuurlijke taal. Ahrefs mat daarvoor een citatiepercentage van 89,8% tegenover 81,1% voor ondoorzichtige slugs.
  • Gerichte pagina's in plaats van één allesomvattende gids. Over 815.000 vraag-paginacombinaties wonnen pagina's die 26% tot 50% van de deelvragen van een motor grondig behandelden het van pagina's die alles oppervlakkig aanstipten.

Actualiteit is het signaal dat je zelf in de hand hebt

AI-citaties zijn gemiddeld 25,7% verser dan organische resultaten, en van de "beste X"-lijstjes die ChatGPT citeerde was 79,1% in het lopende jaar bijgewerkt. Een zichtbaar jaartal in de titel hing in een studie van 22,7 miljoen citaties samen met ongeveer 30% meer citaties.

  • Toon een zichtbare updatedatum, spiegel die in dateModified en gebruik hem als lastmod in de sitemap.
  • Wijzig hem alleen als de tekst echt verandert. De builddatum op elke pagina stempelen vernietigt het signaal en leert crawlers je sitemap te negeren.
  • Stuur bij elke productiedeploy een IndexNow-ping. Bing hercrawlt ingediende URL's binnen enkele minuten, en die index voedt Copilot en een deel van de retrieval van ChatGPT.
  • Verifieer de site in Bing Webmaster Tools, niet alleen in Search Console.

Wat niet werkt, hoe vaak je het ook leest

  • llms.txt. Consumentencrawlers vragen het bestand niet op, Google Search negeert het en geen enkele studie laat meer citaties zien. Nuttig voor code- en agenttooling, geen zichtbaarheidsknop.
  • Schema als hefboom. Ahrefs volgde 1.885 pagina's die structured data toevoegden: AI Overviews bewoog -4,6%, AI Mode +2,4% en ChatGPT +2,2%, alles binnen de ruis. Houd schema kloppend en minimaal voor indexering en rich results, en markeer nooit feiten die niet zichtbaar op de pagina staan.
  • nosnippet en max-snippet op pagina's die je geciteerd wilt zien. Ze halen precies de geschiktheid weg die je zoekt.
  • Pagina's opknippen in fragmenten "voor LLM's", of losse AI-pagina's publiceren. Google zegt dat geen van beide nodig is, en verborgen parallelle content is een beleidsrisico.

Meet waar het verkeer echt zichtbaar wordt

AI-bots draaien geen JavaScript, dus client-side analytics ziet ze nooit, en 35% tot 70% van de menselijke bezoeken via AI komt binnen zonder enige referrer.

  • Serverlogs (een Vercel log drain volstaat) gefilterd op user agent: wie haalde wat op, en met welke statuscode. Alarmeer op 403 en 429 richting elke antwoordcrawler.
  • Een eigen kanaalgroep in GA4 voor AI-assistenten. GA4 kent sinds mei 2026 het medium ai-assistant toe, maar Perplexity komt nog steeds in Referral terecht.
  • Het rapport over generatieve AI in Search Console, sinds 31 augustus 2026 op alle sites beschikbaar, en het AI Performance-rapport van Bing, het enige first-party dashboard dat citaties per URL telt.
  • Een vast panel van 25 tot 40 kopersvragen, maandelijks over de motoren gedraaid, waarbij je vermelding, positie en geciteerde URL vastlegt. Citaties en merkvermeldingen lopen uiteen, dus meet ze allebei.

Niets hiervan is een truc. Het is de gewone discipline van echte HTML serveren, ware dingen in een leesbare volgorde zeggen, en controleren of de machines erbij kunnen.

FAQ

Vragen, beantwoord

Leest ChatGPT de JavaScript van mijn website?
Nee. OAI-SearchBot, ChatGPT-User en GPTBot halen de ruwe HTML op en voeren nooit JavaScript uit, wat Vercel en MERJ bevestigden over ruim 500 miljoen GPTBot-verzoeken. Voor de crawlers van Claude en Perplexity geldt hetzelfde. Alleen Googlebot, Bingbot en Applebot renderen. Verschijnt je content pas na hydratie van React, dan ziet ChatGPT een lege pagina: render elke publieke route statisch voor.
Heb ik een llms.txt-bestand nodig om in AI-zoekresultaten te verschijnen?
Nee. Consumenten-AI-crawlers vragen llms.txt niet op, Google Search negeert het en geen studie toont meer citaties door het te publiceren. Het heeft echte toepassingen voor code- en agenttooling, en als je het publiceert moet je het synchroon houden. Je zichtbaarheid komt van voorgerenderde HTML, een robots.txt die de antwoordcrawlers toelaat, en een antwoord-eerst structuur.
Zorgt schema.org-markup ervoor dat AI mijn pagina's citeert?
Op zichzelf niet. Ahrefs volgde 1.885 pagina's die structured data toevoegden: AI Overviews bewoog -4,6%, AI Mode +2,4% en ChatGPT +2,2%, alles binnen de ruis. Schema blijft nuttig voor indexering, entiteitsherkenning en rich results, dus houd het kloppend en minimaal. De hefboom voor citaties is zichtbare tekst: koppen in vraagvorm met korte, feitelijke, zelfstandige antwoorden.
Hoe weet ik of AI-assistenten mij verkeer sturen?
Niet met Google Analytics alleen. Tussen de 35% en 70% van de via AI verwezen bezoeken komt binnen zonder referrer, en de crawlers verschijnen er nooit omdat ze geen JavaScript draaien. Combineer vier bronnen: serverlogs gefilterd op user agent, een eigen GA4-kanaalgroep voor AI-assistenten, het rapport over generatieve AI in Search Console en het AI Performance-rapport van Bing, dat citaties per URL telt.
Moet ik AI-crawlers blokkeren in robots.txt?
Alleen de trainingscrawlers, en alleen bewust. De zoek- en antwoordagents blokkeren (OAI-SearchBot, Claude-SearchBot, PerplexityBot) haalt je uit de citaties: OpenAI stelt dat een site die OAI-SearchBot weigert niet in de zoekantwoorden van ChatGPT verschijnt. Trainingscrawlers als GPTBot en ClaudeBot zijn een aparte zakelijke afweging. Controleer ook je firewall: een botregel kan ze blokkeren los van robots.txt.

Meer lezen

INITIATE

Start de motor

Vertel ons in een paar korte vragen wat je bouwt. Een senior engineer antwoordt binnen twee werkdagen schriftelijk met een eerste inschatting van scope, planning en prijs.