Hoge Impressies, Weinig Clicks: Worden Je Pagina's Gescraped door AI LLMs?
Future of SEO Leestijd: ~11 minuten

Hoge Impressies, Weinig Clicks: Worden Je Pagina's Gescraped door AI LLMs?

Je impressies in Search Console stijgen, maar je clicks dalen? Dat is geen toeval. Zo herken je AI scraping door ChatGPT, Perplexity en Gemini en zo verdedig je je site met Cloudflare.

Hoge Impressies, Weinig Clicks: Worden Je Pagina's Gescraped door LLMs?

Een vreemd patroon dat we steeds vaker zien in Google Search Console: impressies blijven groeien, maar het aantal clicks zakt. Geen ranking drop, geen straf, geen verloren keywords. Wel: AI assistenten die jouw pagina's lezen in plaats van bezoekers.

Het Patroon: Meer Impressies, Minder Clicks

Een van onze klanten kwam recent met dezelfde vraag waar wij zelf al maanden mee zaten: "Mijn impressies zijn dit jaar bijna verdubbeld, maar mijn clicks zijn gehalveerd. Wat gebeurt er?" Geen ranking drop. Geen Core Update klap. Geen verloren keywords. Toch zakt de CTR week na week verder weg.

Wij zien dit patroon nu op tientallen sites in ons portfolio en op het netwerk van BacklinksWinkel partners. De cijfers wijzen telkens dezelfde kant op: de mens klikt niet meer, de machine leest in zijn plaats. En die machine, of het nu ChatGPT, Perplexity, Claude of Google's eigen Gemini is, laat geen click achter waar Search Console of GA4 hem kan tellen.

De symptomen op een rij

  • Impressies stijgen sneller dan ooit (vaak met dubbele cijfers per maand)
  • Clicks blijven gelijk of dalen ondanks stabiele rankings
  • CTR zakt over de hele linie, niet op specifieke pagina's
  • Sessions in GA4 nemen niet evenredig toe met impressies
  • Server logs tonen pieken in user-agents van AI-bots

Waarom LLMs het Verschil Maken

Search Console meet wat Google ziet: een query, een impressie, en een eventuele click. Vroeger was die click een redelijk betrouwbare proxy voor menselijke aandacht. Iemand zocht iets, Google liet jouw resultaat zien, en de gebruiker klikte door. Tegenwoordig zit er een laag tussen, en die laag heet large language model.

Een gebruiker stelt zijn vraag niet langer aan Google. Hij stelt hem aan ChatGPT, Perplexity, Claude of Gemini. Die assistent gaat vervolgens googlen namens de gebruiker. Het LLM ziet jouw pagina in de resultaten, en, dit is het belangrijkste deel, fetcht de inhoud rechtstreeks bij jouw server om hem samen te vatten. De eindgebruiker ziet alleen het antwoord, niet de bron, en klikt zelden door.

Klassieke flow (2020)

  1. 1. Gebruiker zoekt op Google
  2. 2. Google toont jouw pagina (impressie)
  3. 3. Gebruiker klikt door (click)
  4. 4. GA4 telt een session
  5. 5. Search Console telt impressie + click

LLM flow (2026)

  1. 1. Gebruiker vraagt het ChatGPT
  2. 2. ChatGPT googelt namens de gebruiker (impressie)
  3. 3. ChatGPT fetcht jouw pagina direct (geen click op tracking link)
  4. 4. Antwoord verschijnt in de chat, geen sessie op jouw site
  5. 5. Search Console telt alleen de impressie

Hoe LLMs Google's Tracking Omzeilen

Wanneer je in een normale browser op een Google resultaat klikt, ga je niet direct naar de site. Je gaat eerst langs een Google tracking URL (vaak google.com/url?... of een internal redirect), die de click registreert voordat hij je doorstuurt. Dat is hoe Search Console clicks weet te tellen.

LLM crawlers slaan die stap over. Ze zien in de SERP dat jouwsite.nl/pagina de bron is, en doen vervolgens een directe HTTP-fetch naar die URL. Geen Google tracking parameter, geen referer header die op Google wijst, geen click event. Vanuit Google's perspectief: jouw pagina is getoond, maar er is niet op geklikt. Vanuit jouw perspectief: je server kreeg wel degelijk een request, maar niet van een mens met een browser.

Belangrijk om te onthouden

Een LLM die jouw pagina leest om een vraag te beantwoorden veroorzaakt wel een impressie (de SERP werd opgehaald) maar geen click (de Google tracking link werd niet aangeraakt). Dit drukt je CTR kunstmatig naar beneden, terwijl je content actief gebruikt wordt.

LLM Scraping Herkennen in Je Data

Search Console laat je dit niet rechtstreeks zien, maar er zijn een paar signalen die in combinatie een goede indicator geven. Begin altijd met de vergelijking van twee periodes van gelijke lengte (bijvoorbeeld de afgelopen 90 dagen versus de 90 dagen daarvoor) in de Performance report.

Signaal 1: CTR drop bij stabiele posities

Metric Verwacht patroon LLM-scraping patroon
Impressies Groei gelijk aan ranking-verbetering Sterke groei zonder ranking-verbetering
Gemiddelde positie Stijgt mee met clicks Blijft stabiel of stijgt licht
Clicks Groeit mee met impressies Stagneert of daalt
CTR Stabiel Daalt structureel

Signaal 2: Server logs en user-agents

De meest sluitende bewijslast vind je in je server logs of in je Cloudflare / Vercel analytics. Filter op de bekende AI user-agents en je ziet vaak een explosie in requests die niets met je echte verkeer te maken heeft. Een paar van de belangrijkste:

Bekende AI / LLM user-agents

  • GPTBot – OpenAI's training crawler
  • ChatGPT-User – Live fetches vanuit een ChatGPT gesprek
  • OAI-SearchBot – OpenAI's search index
  • PerplexityBot – Perplexity training
  • Perplexity-User – Live Perplexity antwoorden
  • ClaudeBot / anthropic-ai – Anthropic's crawler
  • Google-Extended – Gemini / AI Overviews training opt-out
  • Meta-ExternalAgent – Meta AI
  • Bytespider – ByteDance / Doubao
  • Applebot-Extended – Apple Intelligence

Signaal 3: Geografische scheefgroei

Open de Performance report in Google Search Console en kijk naar het tabblad Countries. Een Nederlandse webshop hoort impressies vanuit Nederland te zien, met wat ruis uit België en Duitsland. Als je opeens een groei ziet uit landen waar je nooit op gericht bent (vaak via datacenter-IPs die naar VS, Ierland of Singapore wijzen) is dat geen markt-expansie, dat is een bot-cluster.

Impact op Je Rapportages en CTR

Het probleem is niet alleen kosmetisch. Een dalende CTR heeft kettingeffecten in hoe je je SEO meet, in hoe je rapporteert aan stakeholders, en in hoe je beslissingen neemt over content en budget.

Vertekende rapportages

  • CTR benchmarks per positie worden onbetrouwbaar
  • Maand-op-maand vergelijkingen worden misleidend
  • Topic clusters lijken "onderpresterend"
  • Content investeringen lijken niet renderen

Verkeerde conclusies

  • "Onze title tags presteren slechter" (terwijl er niets veranderd is)
  • "Deze pagina werkt niet meer" (terwijl hij in AI antwoorden zit)
  • "We moeten meer betaald inzetten" (terwijl je content wel werkt)
  • "De Core Update heeft ons geraakt" (terwijl het verkeer alleen verschoven is)

Wat dit extra lastig maakt: Google heeft inmiddels een AI Overviews filter aan Search Console toegevoegd, maar die laat alleen je eigen aanwezigheid in Google's eigen AI-resultaten zien. Voor externe LLMs als ChatGPT en Perplexity heb je geen native dashboard. De brondata moet uit je server logs komen.

Verdediging: Cloudflare en Geo-blocking

Voor sommige domeinen in ons portfolio kiezen we bewust voor een agressieve verdediging. Dat is geen one-size-fits-all advies, maar voor lokale dienstverleners (denk: een Nederlandse advocaat, lokale webshop, of NL-only nieuwsplatform) zijn buitenlandse bezoekers vrijwel altijd ruis. We routeren die domeinen door Cloudflare en zetten een paar regels op die het bot-verkeer dramatisch reduceren.

Onze standaard Cloudflare configuratie

Stap-voor-stap voor een NL-only domein

  1. 1. Bot Fight Mode aanzetten

    Cloudflare's eigen heuristiek blokkeert al een groot deel van de bekende bot-netwerken. Te vinden onder Security → Bots.

  2. 2. AI Scrapers en Crawlers blokkeren

    Onder Security → Bots staat sinds 2024 een toggle voor het categorisch blokkeren van AI crawlers. Een muisklik en GPTBot, ClaudeBot, PerplexityBot etc. krijgen een 403.

  3. 3. Country-based WAF rule

    Voor lokale sites: een Firewall Rule die alles buiten NL/BE/DE op een managed challenge zet. Echte mensen vanuit een VPN klikken door, datacenter-traffic uit Singapore loopt vast.

  4. 4. ASN block voor bekende datacenters

    AWS, Google Cloud, Azure, DigitalOcean en Hetzner ASN's blokkeren of challengen levert vaak nog eens 20-40% reductie op in bot-verkeer.

  5. 5. Caching agressief instellen

    Voor de bots die wel doorheen komen scheelt edge caching minstens load op je origin. Voor content sites: cache HTML voor 1 uur op de edge.

Voorbeeld WAF expression

(ip.geoip.country ne "NL" and ip.geoip.country ne "BE")
or (cf.client.bot)
or (http.user_agent contains "GPTBot")
or (http.user_agent contains "ChatGPT-User")
or (http.user_agent contains "PerplexityBot")
or (http.user_agent contains "ClaudeBot")
or (http.user_agent contains "Bytespider")

Set deze rule op "Managed Challenge" in plaats van een harde block. Dat geeft legitieme buitenlandse bezoekers (Nederlanders op vakantie, expats, journalisten) nog steeds toegang via een Turnstile check, terwijl 99% van het bot-verkeer afhaakt.

Let op: niet voor elk domein

Dit werkt voor lokaal-gerichte sites. Heb je een Engelstalig blog of een internationale webshop, dan snijd je met deze setup in je eigen vlees. Test altijd eerst met "Log" actie in plaats van "Block" om te zien wat je zou blokkeren voordat je live gaat.

robots.txt en AI Crawlers Blokkeren

Niet iedereen heeft Cloudflare. Een laagdrempelig alternatief is je robots.txt aanpassen. De grote AI partijen respecteren deze meestal (de kleine of malafide niet, daarom blijft Cloudflare effectiever). Dit blok zet je in /robots.txt:

User-agent: GPTBot
Disallow: /

User-agent: ChatGPT-User
Disallow: /

User-agent: OAI-SearchBot
Disallow: /

User-agent: PerplexityBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: anthropic-ai
Disallow: /

User-agent: Google-Extended
Disallow: /

User-agent: Bytespider
Disallow: /

User-agent: Applebot-Extended
Disallow: /

User-agent: Meta-ExternalAgent
Disallow: /

Belangrijk detail: Google-Extended blokkeren stopt Google's AI training en AI Overviews, maar niet de gewone Google search index. Dat is precies wat je wilt: wel gewoon ranken, niet voer voor Gemini worden.

Strategie: Laten of Weren?

De vraag of je LLM scraping moet blokkeren is niet zwart-wit. Er zit een echte trade-off in: in AI antwoorden verschijnen kan brand visibility opleveren, en sommige LLMs (Perplexity, ChatGPT search, Gemini) tonen de bron met een klikbare link. Een deel van je publiek vindt je via die route.

Site type Aanbeveling Reden
Lokale dienstverlener (NL) Blokkeren Doelgroep is geografisch beperkt, LLM scraping levert geen leads op
Affiliate / content site Blokkeren Content is je product; gratis weggeven verzwakt je positie
SaaS / B2B Selectief Blog open laten (brand exposure), pricing en docs afschermen
E-commerce internationaal Open laten Productpagina's in AI shopping antwoorden zijn waardevol
Nieuwsmedia Blokkeren (of licentie) Onderhandelen over betaalde toegang i.p.v. gratis trainingsdata

Tussenweg: Cloudflare's Pay-Per-Crawl

Cloudflare introduceerde in 2025 een functie waarmee je AI crawlers niet hoeft te blokkeren of toelaten, maar laat betalen per crawl. Voor sites met substantiele content kan dit een interessante monetisatiestrategie zijn, vergelijkbaar met hoe zero-click searches ons dwingen om opnieuw na te denken over hoe waarde uit content komt.

Conclusie en Actieplan

Dalende CTR bij stijgende impressies is in 2026 geen anomalie meer. Het is een symptoom van een fundamentele verschuiving in hoe mensen het web gebruiken: ze vragen het de AI, en de AI vraagt het jou. Search Console meet alleen wat Google zelf in handen heeft, en dat is steeds minder.

Direct aan de slag

Een praktische checklist om vanaf vandaag grip te krijgen op LLM scraping en je rapportages weer betrouwbaar te maken.

Deze week:

  • ✓ Open Search Console en vergelijk CTR per land en device over 90 dagen
  • ✓ Check je server logs of Cloudflare analytics op AI user-agents
  • ✓ Voeg de robots.txt blokken voor GPTBot/ChatGPT-User/PerplexityBot/ClaudeBot toe
  • ✓ Activeer Cloudflare's "Block AI Scrapers and Crawlers" toggle

Deze maand:

  • ✓ Beslis per domein of LLM scraping schade of waarde oplevert
  • ✓ Bouw een geo-WAF rule voor lokaal-gerichte domeinen
  • ✓ Voeg een "bot-traffic" segment toe in je SEO rapportage
  • ✓ Communiceer met stakeholders over de nieuwe CTR baseline

Websites, prijzen en pakketten vergelijken

Bekijk beschikbare websites op categorie, DR en prijs bij backlinks kopen. Zoek je hulp bij selectie en planning, bekijk dan linkbuilding uitbesteden.

Meer Leren Over SEO & Linkbuilding?

Ontdek alle artikelen in onze uitgebreide kennisbank