AI-bedrijven moeten een watermerk geven aan de teksten en beelden die hun modellen genereren. Dat is sinds vorige maand een Europese verplichting, om misinformatie en manipulatie tegen te gaan.

In een blogpost gaat Anthropic, het Amerikaanse bedrijf dat chatbot Claude maakt, uitgebreid in op de watermerktechnologie voor AI-teksten. Volgens het bedrijf is het watermerk onzichtbaar voor lezers en zal het geen enkele invloed op de kwaliteit van de tekst hebben – een vrees die breed leeft onder AI-gebruikers. Een onzichtbaar watermerk, wat voor zin heeft dat? En hoe werkt het?

Claudes watermerktechnologie blijkt een variant op SynthID, een techniek die in 2024 door onderzoekers van Google DeepMind werd ontwikkeld. Hun eigen chatbot Gemini voegt al sinds november een watermerk toe, en ook OpenAI zegt bezig te zijn met implementatie voor teksten van ChatGPT.

Het ‘watermerk’ zit hem in de keuze van woorden. Een large language model (LLM) voorspelt welk woord het beste na de vorige woorden kan komen. Dat doet het op basis van de gestelde vraag (de ‘prompt’), de al gegenereerde tekst en heel veel andere variabelen. Meestal is er niet maar één goede optie – soms zijn er synoniemen, of kan een zin ook net anders geschreven worden, zonder dat het de kwaliteit of betekenis van de tekst verandert. Welke van de opties gekozen wordt is willekeurig, dus wanneer een chatbot vijf keer dezelfde vraag krijgt, genereert het vijf verschillende geschikte antwoorden. En precies die willekeur wordt gebruikt om een watermerk toe te voegen.