Pew liep bijna een half miljoen pagina’s door een AI-detector

Pew Research Center heeft 499.999 webpagina’s door een AI-detector gehaald en op 10% tekenen van AI-auteurschap of AI-editing gevonden. Beperk je de steekproef tot pagina’s gepubliceerd na de lancering van ChatGPT, dan stijgt dat cijfer naar 35%. Het rapport verscheen op 20 augustus.

Wat er precies uit de data komt

.com-domeinen scoren ongeveer tien keer zo hoog als .edu en .gov. Over een periode van zes maanden zat .com op 9,35%, .org op 4,59%, .edu op 1,03% en .gov op 0,76%. Vóór ChatGPT zaten alle vier typen nog onder de 1%. Sindsdien is .com het snelst gestegen, terwijl .edu en .gov nauwelijks van die 1% zijn afgeweken.

Pew keek ook naar specifieke taalkundige signalen in post-ChatGPT-content. Het gebruik van em dashes steeg van 5,79 naar 11,19 per 10.000 woorden. Oxford-komma’s namen met 63% toe. Woorden die typisch zijn voor AI-teksten, zoals “delve”, “interplay” en “testament”, zijn meer dan verdubbeld. Pew zegt er zelf bij: geen van deze markers pinpoint een individueel document, het gaat om patronen over grote datasets.

Andere schattingen lopen behoorlijk uiteen. SEO-bureau Graphite stelt dat in Q1 2026 al 49,9% van nieuw gepubliceerde Engelstalige artikelen primair AI-gegenereerd is. Een (niet peer-reviewed) preprint van Imperial College London, Internet Archive en Stanford komt op 35% voor nieuw gepubliceerde websites halverwege 2025. Alle drie de studies leunen deels op dezelfde detector, Pangram, wat vergelijken lastig maakt.

Eén belangrijk punt dat Pew zelf aangeeft: hun drempelwaarde detecteert ook AI-editing. Een pagina die een mens schreef en vervolgens even door een AI-tool haalde, valt in dezelfde categorie als een volledig gegenereerde pagina. Met AI-editing nu als standaardfunctie in Google Docs en Microsoft Word is dat geen detail.

Wat dit voor jou betekent

De concentratie zit precies waar het grootste deel van SEO-werk plaatsvindt: commerciële .com-domeinen. Ik zie dit bij klanten ook: redacties gebruiken AI om teksten aan te scherpen, zonder dat ze dat als “AI-content” beschouwen. Technisch gezien valt het er wel onder.

Voor E-E-A-T is dit relevant. Google heeft nooit gezegd dat AI-content verboden is, maar beoordeelt wel of content helpful en origineel is. Als 35% van de post-ChatGPT-pagina’s detecteerbare AI-patronen heeft, wordt het onderscheiden van jouw content steeds belangrijker. SEO-teksten slim inkopen betekent in 2026 nadenken over wat menselijke expertise en originele invalshoeken toevoegen, niet alleen over het productietempo.

Controleer ook gewoon wat je eigen content doet: zijn er AI-markers binnengeslopen via editing-tools die je redactie dagelijks gebruikt? Niet omdat Google jou direct afstraft, maar omdat generieke “delve”-teksten het in de SERP steeds moeilijker hebben.

Bron: Search Engine Journal