AI-ontwikkelaar Anthropic voorziet tekst en bestanden die door Claude-modellen worden gegenereerd van een onzichtbaar, machinaal leesbaar watermerk. Het bedrijf ondertekende de gedragscode voor artikel 50, lid 2 van de Europese AI Act over transparantie van AI-gegenereerde content. De maatregel geldt direct voor nieuwe Claude-modellen en wordt stapsgewijs uitgerold naar bestaande versies.
Anthropic kondigt aan dat alle tekst en bestanden die door zijn Claude-modellen worden gegenereerd, worden voorzien van een onzichtbaar, machinaal leesbaar watermerk. Volgens het bedrijf maakt deze stap onderdeel uit van het voldoen aan de gedragscode voor artikel 50, lid 2 van de Europese AI Act, die transparantie van AI-gegenereerde content regelt. Anthropic geeft aan dat de maatregel bedoeld is om de herkomst van AI-content herkenbaarder te maken.
Twee markeringsmethoden
Anthropic zet twee technieken in om gegenereerde content te markeren. Bij tekstgeneratie weeft het model een watermerk direct in de gekozen woorden, zonder dat dit volgens het bedrijf invloed heeft op leesbaarheid of kwaliteit van de tekst. Het watermerk blijft volgens Anthropic aanwezig wanneer tekst wordt gekopieerd, geplakt of licht bewerkt.
Bij gegenereerde bestanden zoals .svg, .png en .jpg voegt Claude ondertekende herkomstmetadata toe op basis van de open C2PA-standaard (Coalition for Content Provenance and Authenticity). Deze standaard maakt het volgens Anthropic mogelijk te controleren of een bestand door AI is verwerkt of achteraf is aangepast.
Directe toepassing voor nieuwe modellen
Alle Claude-modellen die op of na 2 augustus 2026 in de Europese Unie worden uitgebracht, ondersteunen de markeringen vanaf de release. Voor bestaande modellen voert Anthropic de technologie gefaseerd in tijdens een overgangsperiode.
De watermerken gelden voor alle platforms waarop Claude beschikbaar is, waaronder de Claude API, Claude Code en Claude Cowork, en voor integraties via cloudpartners zoals AWS, Google Cloud en Microsoft Foundry.
Beperkingen van de technologie
Anthropic werkt aan tools waarmee gebruikers en derden watermerken en metadata kunnen detecteren. Het bedrijf wijst tegelijk op de grenzen van de aanpak. Een aanwezig watermerk toont volgens Anthropic niet aan dat een tekst volledig door AI is opgesteld, omdat veel gebruikers Claude inzetten om eigen teksten te herschrijven, vertalen of samenvatten. Daarnaast kunnen zeer korte teksten, ingrijpende herformuleringen of een screenshot van een afbeelding het watermerk of de metadata beschadigen of laten verdwijnen.
Anthropic kondigt aan op korte termijn technische documentatie te publiceren om ontwikkelaars te ondersteunen bij het voldoen aan hun eigen transparantieverplichtingen onder de AI Act.