AI kan je vinden. Dat is niet genoeg

SEO-teams hebben de afgelopen twee jaar hard gewerkt aan AI-zichtbaarheid: code opgeschoond, content gechunked, robots.txt bijgewerkt. En als je merk nu regelmatig geciteerd wordt in AI-antwoorden of AI Overviews, voelt dat als winst. Terecht, maar het is niet het hele verhaal. Uit een audit van 50 grote websites door het team van SALT.agency blijkt dat bijna geen enkele site AI écht in staat stelt om de inhoud te begrijpen, en dat bijna twee derde het toegangsbeleid voor AI-bots volledig aan het toeval overlaat.

Drie lagen, en de meeste sites steken na laag één

De onderzoekers werken met een framework van drie lagen:

Retrievability: kan AI je content ophalen en parsen? Dit overlapt sterk met klassieke technische SEO en scoort gemiddeld 74,4%. De meeste sites doen dit redelijk.

Attribution and Meaning: kan AI bepalen wat je pagina’s betekenen en van wie ze zijn? Denk aan het verschil tussen een productprijs en een kortingsprijs, of tussen Jaguar het automerk en een voetbalclub met dezelfde naam. Gemiddelde score: 38,5%. Hier gaat het mis.

Agent Transaction and Discovery: kunnen AI-agents daadwerkelijk taken uitvoeren op je site, zoals een transactie afronden? Dit is de frontier: de meeste sites zijn hier nog lang niet klaar voor.

Die scherpe dip naar laag twee is het meest veelzeggend. JSON-LD structured data staat op 70% van de homepagina’s, wat oké is. Maar 30% heeft dus helemaal niets. En schema is precies het mechanisme waarmee AI weet dat een getal een prijs is, en niet een artikelnummer of een kortingscode. Zonder die context gokt het model. En dat gokken leidt tot verkeerde citaties, of erger: hallucinations over jouw merk.

Nog opvallender: slechts 5 van de 50 sites hebben Cloudflare’s Content Signals Policy geïmplementeerd. Dat zijn directives in je robots.txt die AI-crawlers vertellen wat ze wel en niet mogen doen met je content, voor zoekindexering, live AI-antwoorden én modeltraining. Twee derde laat dit dus volledig open. Geen beleid is ook een beleid, alleen niet één jij zelf hebt gekozen.

Wat moet je nu doen

Ik zie dit bij klanten ook regelmatig: de technische basis is op orde, maar zodra je vraagt naar structured data buiten de homepage, of naar AI-specifieke user-agent directives, wordt het stil. Drie dingen die je nu kunt checken:

  1. JSON-LD op productniveau. Niet alleen op de homepage. Check in de broncode van je product- en categoriepagina’s of schema aanwezig is en of het semantisch klopt. Gebruik de Rich Results Test van Google.

  2. Robots.txt en AI user-agent directives. Welke AI-bots geef je toegang tot welke content? Dit is nu volledig handwerk, maar het is ook jouw keuze om te maken. Bekijk welke AI-zoekaagenten er inmiddels actief zijn en of je hun toegang bewust hebt ingesteld.

  3. Content Signals Policy. Weinig mensen kennen dit, maar als je je content actief wilt beschermen of juist beschikbaar wilt stellen voor modeltraining en live AI-antwoorden, is dit het mechanisme daarvoor.

De gemiddelde score in het onderzoek is 56,6%. Dat klinkt als een voldoende, maar het is dat niet. Zeker niet als je bedenkt dat botverkeer menselijk webverkeer inmiddels overtreft en AI-agents steeds vaker de eerste interactie met je merk zijn, niet de gebruiker zelf.

Bron: Search Engine Journal