
97 procent van Nederlandse websites staat AI-training toe
Europees onderzoek toont aan dat Nederlandse websites niet duidelijk voor of tegen het trainen van AI-taalmodellen zijn. Minder dan 10 procent heeft een bewuste keuze gemaakt en van de rest staat het grootste deel het toe. Maar, is dat wel zo slordig als de cijfers het doen lijken?
Sinds de komst van generatieve AI heerst er commotie over hoe deze de taalmodellen traint. Voor zowel tekst als beeld en muziek pakten modellen alles wat er online te vinden was, zonder rekening te houden met copyright of ander eigenaarschap. Onderhand hebben eigenaren meer zeggenschap over of AI wel of niet getraind mag worden met hun informatie. Uit onderzoek blijkt echter dat een groot deel van de Nederlandse websites hier niets mee doet.
Relatief veel Nederlandse websites accepteren AI-training
Het onderzoek is gedaan door Piperic, een AI-analysewebsite van de Hongaarse ondernemer Rácz-Akácosi Attila. Hierin zijn meerdere Europese websites onderzocht op het robots.txt-bestand. Dat is, kort uitgelegd, een document met instructies die AI-crawlers lezen tijdens het zoeken naar trainingsdata. Als hierin staat vermeld dat de AI geen toegang heeft, slaat deze de website over.
En wat blijkt? Van de 681.071 geanalyseerde Nederlandse websites heeft slechts 7 procent überhaupt zo’n document. De rest niet en geeft daarmee indirect toestemming voor AI-training. Daar is wat van te vinden, maar websites zijn immers "Public by Default". Slechts 0,6 procent van de websites blokkeert AI volledig. Onder 5180 nieuwssites ligt dat aantal op 4,7 procent. Van de 175.126 Nederlandse webshops houdt 2,5 procent AI buiten de deur. Met deze cijfers staan we op plek 9 van de 43 onderzochte landen, als het aankomt op acceptatie van AI-crawlers.
Sta je niet toe, dan doe je niet mee
Wereldwijd steken grote online uitgevers de handen ineen om AI-bedrijven voor de rechter te slepen. Eerder deze week spanden grote uitgevers Hachette, Cengage en Elsevier nog een rechtszaak aan tegen Google en ook in Europa stappen uitgevers naar de rechter. Toch blijft het een moeilijke kwestie, omdat het online zoekgedrag van gebruikers ook naar AI-tools verschuift.
Als uitgevers hun websites uitsluiten van AI-training, worden deze mogelijk ook niet meegenomen in de antwoorden van AI-bots en AI-overzichten in Google. En daarmee versterken ze de afname in websitebezoekers, dankzij de introductie van AI-tools. Uitgevers zijn dus als het ware ‘verplicht’ om AI toe te staan, ten gunste van hun bezoekers en dus inkomsten.

















