©Unsplash

De jacht op AI-bots dreigt publieke data achter slot en grendel te zetten
Ondanks een recente tegenslag in de rechtbank geven Google en Reddit de strijd tegen AI-bots die zoekresultaten scrapen niet op. Beide techreuzen hebben webscraper SerpApi aangeklaagd op basis van de Amerikaanse auteurswetgeving (ook wel bekend als DMCA).
Dit is een opmerkelijke aanpak van Google en Reddit, aangezien op algemene zoekresultaten helemaal geen copyright rust. Google stelt echter dat SerpApi beveiligingen omzeilt, wat het bedrijf inkomsten kost en de rechten schaadt van makers van wie de content verschijnt in de zogenaamde kennisvensters naast de zoekresultaten.
SerpApi is overigens een real-time api-dienst die zoekresultaten van zoekmachines zoals Google, Bing en Amazon verzamelt, ontleedt en omzet in gestructureerde JSON-data. Het lost technische blokkades zoals proxy's en captcha’s automatisch voor je op.
Haken en ogen
De rechter wees de zaak van Google in eerste instantie af: het bedrijf is immers geen eigenaar van de uitgelichte content en heeft daardoor geen poot om op te staan. Google krijgt nog een kleine kans om de aanklacht aan te passen door zich puur te richten op gelicentieerd materiaal in die vensters, maar daar zitten, helaas voor Google, wat haken en ogen aan.
Dit kan namelijk leiden tot lastige vragen over het materiaal waarvoor Google geen licenties geregeld heeft. Ook voor de parallelle rechtszaak van Reddit voorspelt dit weinig goeds, aangezien die evenmin de eigenaar is van de content die via Google weergegeven wordt.
Wie is de eigenaar van het internet?
SerpApi en techexperts waarschuwen ondertussen voor een groter gevaar: het afsluiten van het open internet. Ze beschuldigen platforms als Reddit en Google, ironisch genoeg zelf de grootste scraper ter wereld, ervan zich onterecht op te werpen als tolheffers. voor publieke data. De Europese Unie heeft dergelijke partijen al aangemerkt als poortwachters, vanwege hun macht.
De massale tegenreactie op AI-scraping wordt ook wel de api-apocalyps genoemd. Het afschermen van dit soort data raakt namelijk niet alleen commerciële AI-bedrijven, maar belemmert ook academische onderzoekers, archivarissen en journalisten die voor hun werk afhankelijk zijn van geautomatiseerde toegang tot het web. Hier staat dus iets op het spel.
















