©Anthropic

Watermerk op je AI-teksten: zo werkt het
Anthropic kondigde afgelopen week aan teksten van Claude te voorzien van een watermerk. Nu legt het bedrijf uit hoe dat werkt.
Toekomstige modellen van Claude gaan gegenereerde teksten voorzien van een watermerk, die blijft zitten als je de tekst kopieert en zelfs bewerkt. In een blog zegt Anthropic veel reacties op dit nieuws gekregen te hebben, dus geeft het bedrijf duidelijkheid.
Anthropic beweert dat het watermerk geen effect heeft op de kwaliteit van de teksten. Lezers zien daarnaast het verschil niet tussen een tekst met een watermerk en een tekst zonder watermerk. Er wordt ook niets aan de tekst toegevoegd, zelfs geen verborgen karakters.
Zo werkt het
Hoe werkt het dan wel? Bij het genereren van een tekst moet de AI regelmatig kiezen tussen verschillende woorden. Soms moeten dat specifieke woorden zijn die passen bij de tekst die ervoor is geschreven, maar andere keren wordt een keuze gemaakt uit synoniemen die de betekenis van de tekst niet aanpassen. Dat gebeurt op de achtergrond door een willekeurig nummer te kiezen. Deze nummers maken in een tekst een soort patroon. Dit patroon wordt door lezers niet herkend, maar wel door iemand die de sleutel tot het patroon heeft via een API.
Dit watermerk is een versie van SynthID-Text, zoals Google DeepMind in 2024 in een paper in Nature heeft uitgelegd. Het watermerk werkt het beste met langere teksten die door Claude zijn gegenereerd. Als er veel van dit soort woorden na afloop worden veranderd, dan is het watermerk minder effectief.
Op deze website wordt het proces visueel gemaakt.
















