Wat AI-crawlers zien – en wat niet

Veel van wat in de dagelijkse SEO-praktijk als vanzelfsprekend wordt beschouwd, is onzichtbaar voor LLM's in gespreksmodus. De nieuwe Writesonic-studie 2026 heeft zes grote LLM-crawlers (ChatGPT, Claude, Gemini-Conversation, Perplexity, Bing Copilot, Google AI Overviews) geanalyseerd en bevestigt: alle inhoud moet zo worden aangeboden dat deze begrijpelijk blijft zonder JavaScript, zonder veel scrollen en zonder metadata in de head.
De drie crawler-tiers (HTML-only / Headless / Full-browser)
Voor de classificatie helpt een eenvoudig model, waarin de huidige LLM-crawlers meestal in Tier 1–2 vallen:
- Tier 1: HTML-only Parser – leest statische HTML, volgt links beperkt, voert geen JavaScript uit, scrollt niet.
- Tier 2: Headless Light – kan HTML robuuster parsen, houdt rekening met individuele fallbacks (bijv. <noscript>), maar zonder echte rendering of scrollen.
- Tier 3: Full-browser – voert JavaScript en complexe rendering uit en scrollt. In de studie domineren echter gedragingen uit Tier 1–2.
Wat alle 6 LLM's betrouwbaar zien — en wat niet
De Writesonic-tests onthullen duidelijke patronen:
- 3 van de 6 LLM's voeren geen JavaScript uit. JS-only-inhoud (SPA's, aan de clientzijde geïnjecteerde reviews, lazy-load inhoud) blijft onzichtbaar.
- 0 van de 6 LLM's lezen JSON-LD in Live-Conversation-modus. Belangrijk: JSON-LD blijft relevant voor de Google-zoekindex – twee verschillende werelden.
- 0 van de 6 LLM's lezen meta-description of OG-tags in de Conversation-modus.
- 5 van de 6 LLM's lezen de <title>-tag betrouwbaar. Het is daarmee het belangrijkste head-element voor LLM-read.
- 0 van de 6 LLM's scrollen. Inhoud „below the fold“ en lazy-loaded afbeeldingen/tekstblokken worden genegeerd.
- 4 van de 6 LLM's lezen <noscript>-fallbacks.
- Via CSS verborgen content (bijv. display:none, accordeons) is zichtbaar; ::before/::after-pseudo-inhoud is onzichtbaar.
- Microdata in de body wordt beter gelezen dan JSON-LD in de head.
Title-tag is het nieuwe goud — praktijkgerichte aanbeveling
Als 5 van de 6 crawlers de titel betrouwbaar lezen, wordt dit de centrale hefboom. Aanbevelingen:
- Nauwkeurig, informatief, minder dan 60 tekens; vermijd nietszeggende frasen.
- Structuurvoorstel: Primair onderwerp | concreet voordeel | merk.
- Varieer per paginatype (categorie, product, adviesgids), maar houd de terminologie consistent.
- Plaats de sterkste termen vooraan; merknaam aan het einde, tenzij er een sterke vraag naar het merk is.
- Synchroniseer H1 en titel semantisch, zonder een blinde kopie: de titel vat samen, de H1 licht toe.
JSON-LD is niet dood, maar Microdata wint bij LLM-read
De studie toont aan: in de Conversation-modus wordt JSON-LD niet gelezen, terwijl Microdata in de body dat wel wordt. Handelingsadvies:
- Behoud JSON-LD voor de zoekindex (producten, FAQ's, organisatie, breadcrumbs).
- Spiegel kritieke feiten aanvullend als Microdata direct in de zichtbare body (prijzen, beschikbaarheid, beoordelingen), inhoudelijk identiek aan de JSON-LD.
- Vermijd tegenstrijdigheden tussen gestructureerde gegevens en zichtbare tekst.
- Gebruik semantische HTML-elementen (article, header, nav, main, footer) om de body-inhoud helder te structureren voor parsers.
Lazy Loading & Below-the-fold — de onderschatte killers
Omdat 0 van de 6 LLM's scrollen, sluiten lazy-load-mechanismen centrale inhoud af van waarneming. Consequenties:
- Plaats de kernboodschap, product-USP's, prijzen en primaire calls-to-action boven de eerste viewport-hoogte.
- Laad hero-relevante afbeeldingen/tekstinhoud zonder lazy-load (of met een server-side inline fallback). Gebruik geen puur client-side injectie voor hoofdinhoud.
- Bied <noscript>-fallbacks aan voor kritieke assets (bijv. statische productafbeeldingen, tekstfragmenten).
- Controleer SPA's en review-widgets: zonder server-side rendering blijven ze onzichtbaar.
Wat onze audit hiermee doet
We breiden technische audits uit met vier gerichte checks en passen de wegingen matig aan:
- title_tag_present: Controleert het bestaan, de lengte en de precisie van de title-tag per URL.
- lazy_loaded_main_content: Waarschuwing als essentiële inhoud uitsluitend lazy-loaded is of pas na interactie zichtbaar wordt.
- noscript_fallback_present: Legt vast of er een <noscript>-fallback bestaat voor kritieke afbeeldingen/tekstmodules.
- css_generated_critical_content: Meldt risico wanneer relevante copy via CSS-pseudoelementen (::before/::after) wordt gegenereerd. De weging van individuele on-page signalen wordt gematigd verschoven ten gunste van above-the-fold-HTML en de kwaliteit van semantische opmaak.
Conclusie & 5 concrete maatregelen voor shopeigenaren
De studie scheidt klassieke SEO-signalen van wat LLM's in de dialoogmodus daadwerkelijk detecteren. Zet in op robuuste, HTML-first geleverde inhoud en beveilig kritieke informatie tegen rendering-beperkingen. Vijf geprioriteerde maatregelen:
- Titel-programma aanscherpen: Elke categoriepagina en elk product krijgt een nauwkeurige, korte, voordeelgerichte titel.
- Above-the-fold versterken: USP, prijs, beschikbaarheid, primaire CTA en een beschrijvende alinea direct in de server-rendered HTML.
- Progressive Enhancement in plaats van JS-only: SPA's en widgets draaien met SSR/ISR of statische fallbacks; injecteer geen kritieke copy via JavaScript.
- Gestructureerde gegevens dubbelen: JSON-LD behouden, maar sleutelinformatie aanvullend als Microdata in de body markeren.
- Fallback- en CSS-check: <noscript>-fallbacks voor kernmodules; geen bedrijfskritische teksten in ::before/::after tonen.
De Writesonic-resultaten bieden hiermee duidelijke kaders: wat niet in de initiële HTML en boven de vouw staat, bestaat feitelijk niet voor veel LLM's. Stem uw templates dienovereenkomstig af en valideer regelmatig met echte crawler-checks.