Google verloor zijn scrapingszaak, en de consequenties zijn groter dan je denkt
Op 20 juli verwierp Chief Judge Yvonne Gonzalez Rogers de DMCA-claims van Google tegen SerpApi, een bedrijf dat op industriële schaal Google-zoekresultaten scrapt en doorverkoopt via een API, steeds vaker aan AI-bedrijven. Google stelde dat SerpApi illegaal zijn anti-botsysteem SearchGuard had omzeild, vergelijkbaar met het kraken van kopieerbeveiliging op een dvd. De rechter trapte er niet in.
Haar redenering is simpel en stevig: SearchGuard beschermt Google’s advertentie-inkomsten, geen auteursrechtelijk beschermd werk. Een muur om je businessmodel is geen slot op een auteursrechtelijk bestand. De DMCA-claims werden grotendeels afgewezen met prejudice, met uitzondering van een smalle kwestie over Knowledge Panel-afbeeldingen.
Eerlijk principe, lelijk verpakt
Ik snap de ironie volledig. SerpApi is geen sympathieke partij: ze scrapen op grote schaal en verkopen dat door aan precies de AI-bedrijven die de hele sector zenuwachtig maken. En Google is een bedrijf dat twee decennia lang andermans pagina’s heeft gecrawld om de grootste zoekmachine ter wereld te bouwen, en nu verbaasd kijkt als iemand datzelfde trucje op hen toepast. Dat is geen juridisch argument, dat is gewoon lef.
Maar de rechtbank tekende de juiste lijn: als iets op het open web staat, mag een machine het lezen. Die consistentie moet aan beide kanten gelden, ook als Google de ontvangende partij is.
Wat dit voor jou betekent als site-eigenaar
Hier wordt het praktisch. De meeste websites draaien een anti-botmuur die hun revenue model beschermt, niet een auteursrechtelijk werk. Dit vonnis zegt expliciet: dat soort muur geeft je geen DMCA-bescherming.
En dat raakt een bredere discussie. Botverkeer overtreft inmiddels menselijk webverkeer, en slechts een fractie van alle zoekopdrachten leidt nog naar het open web. De vraag op welke voorwaarden geautomatiseerde bezoekers welkom zijn op jouw site, wordt dus steeds urgenter beantwoord door rechtbanken in zaken waar jij geen partij bent.
Mijn advies: wacht niet op die uitkomst. Besluit nu actief wat je open wil houden en wat niet, per crawler, bewust. De meeste hosts en CDN’s geven je al de tools om dat te regelen op blokniveau. Gebruik ze, en documenteer waarom je die keuze maakt.
Check ook of je robots.txt en eventuele crawler-instellingen nog kloppen met wat je eigenlijk wilt. Niet omdat de rechter je daartoe verplicht, maar omdat het jouw enige echte stuurmoment is in een discussie die anders volledig zonder jou wordt gevoerd.
Bron: Search Engine Journal