Anthropic brengt onzichtbare watermerken aan in tekst van Claude, ook bij door mensen bewerkte teksten
Belangrijkste punten
- •Claude-modellen die vanaf 2 augustus in de EU worden gelanceerd, bevatten bij releasedatum machineleesbare watermerken, met plannen om de technologie uit te breiden naar oudere modellen.
- •De watermerken worden wereldwijd toegepast op alle ondersteunde Claude-producten, in plaats van te worden beperkt tot EU-gebruikers.
- •Door mensen geschreven inhoud die door Claude is bewerkt, vertaald of geredigeerd, kan ook het watermerk dragen, zelfs wanneer het oorspronkelijke werk onafhankelijk is geschreven.
- •Anthropic waarschuwde dat zwaar parafraseren, korte tekstpassages of bestandsconversies watermerken en metadata ondetecteerbaar kunnen maken, wat hun betrouwbaarheid als bewijs van AI-auteurschap beperkt.
- •Alle grote AI-aanbieders die in de EU actief zijn, waaronder OpenAI, Google en Meta, krijgen vergelijkbare markeringsverplichtingen onder de transparantiebepalingen van de AI Act.

Anthropic heeft aangekondigd onzichtbare watermerken te gaan inbedden in tekst die door zijn Claude AI-modellen wordt geproduceerd, als reactie op nieuwe transparantie-eisen onder de EU AI Act, 's werelds eerste uitgebreide AI-regelgeving. De watermerken zijn ontworpen om AI-gegenereerde inhoud gemakkelijker identificeerbaar te maken, maar het systeem zal ook tekst markeren die oorspronkelijk door mensen is geschreven en vervolgens door Claude is bewerkt of verwerkt — een reikwijdte die het bepalen of materiaal daadwerkelijk door AI is gemaakt kan bemoeilijken.
Het in San Francisco gevestigde AI-bedrijf kondigde op dinsdag aan dat Claude-modellen die vanaf 2 augustus in de EU worden gelanceerd, bij releasedatum machineleesbare watermerken zullen bevatten. Anthropic werkt er ook aan om de technologie uit te breiden naar oudere modellen.
Hoewel de watermerken werden geïntroduceerd om te voldoen aan de EU AI Act, bevestigde Anthropic dat de markeringen wereldwijd zullen gelden waar ondersteunde Claude-modellen beschikbaar zijn, waaronder Claude, Claude Code en het ontwikkelaarsplatform.
Tekst die door de modellen wordt gegenereerd, zal een ingebed watermerk dragen dat volgens Anthropic standhoudt bij kopiëren-en-plakken en een zekere mate van bewerking kan overleven. Afbeeldingen en andere ondersteunde bestandstypen zullen ondertekende metadata dragen waaruit blijkt dat ze door Claude zijn verwerkt.
Anthropic is van plan hulpmiddelen beschikbaar te stellen waarmee gebruikers en derden de watermerken kunnen detecteren, hoewel de technische specificaties nog niet zijn bekendgemaakt.
De aankondiging komt te midden van toenemende druk van toezichthouders en uitgevers op AI-bedrijven om synthetische inhoud beter identificeerbaar te maken, na een sterke toename van door machines gegenereerd materiaal op het internet. Onder de transparantiebepalingen van de EU AI Act moeten alle grote AI-aanbieders die in de blok actief zijn — waaronder OpenAI, Google en Meta — vergelijkbare verplichtingen nakomen om AI-gegenereerde output te markeren. Verschillende rechtsgebieden buiten de EU, waaronder het VK en individuele Amerikaanse staten, ontwikkelen eveneens hun eigen eisen voor AI-labeling. City AM heeft eerder gerapporteerd over de verspreiding van AI-gegenereerde "slop" in nieuwsredacties, waaronder opiniestukken en pitches die bedrieglijk werden gepresenteerd als het werk van executives en andere bijdragers.
Ook door mensen geschreven tekst kan worden gemarkeerd
Anthropic erkende dat het detecteren van een van zijn watermerken niet noodzakelijkerwijs betekent dat Claude de oorspronkelijke inhoud heeft geschreven. Een gebruiker kan zelfstandig een artikel schrijven en vervolgens Claude vragen om het te redigeren, te vertalen of te bewerken — en de resulterende tekst kan nog steeds het watermerk van Claude dragen, ook al zijn de onderliggende inhoud en ideeën afkomstig van de menselijke auteur.
Artikel 50 van de EU AI Act bepaalt dat de markeringsvereisten niet gelden wanneer een AI-systeem "een ondersteunende functie vervult voor standaardbewerking" of de inhoud of de betekenis ervan niet wezenlijk wijzigt. Anthropic heeft de vrijwillige gedragscode van de EU ondertekend waarin wordt uiteengezet hoe bedrijven kunnen voldoen aan de transparantieverplichtingen, maar de beslissing om watermerken toe te passen op alle ondersteunde Claude-output betekent dat het systeem materiaal kan markeren dat verder gaat dan wat de wetgeving strikt vereist.
Het bedrijf waarschuwde ook om de watermerken niet te beschouwen als definitief bewijs van AI-auteurschap. Zware bewerking of parafraseren kan een watermerk ondetecteerbaar maken, en korte passages bevatten mogelijk onvoldoende tekst om een betrouwbaar signaal te produceren. Metadata gekoppeld aan afbeeldingen en andere bestanden kan ook verloren gaan wanneer bestanden worden geconverteerd of als screenshot worden gemaakt.
Detectietechnologie nog niet perfect
Alex Cui, chief technology officer bij AI-detectiebedrijf GPTZero, legde in een bericht op X uit dat tekstwatermerken doorgaans werken door subtiel de waarschijnlijkheid van woordselecties binnen een model te veranderen, waardoor een statistisch patroon ontstaat dat later kan worden gedetecteerd.
Cui merkte echter op dat de technologie nog steeds niet perfect is en stelde dat watermerken mogelijk moeite hebben om "intensief parafraseren" te doorstaan. Hij waarschuwde ook dat het publiekelijk beschikbaar maken van detectietools het voor gebruikers gemakkelijker kan maken om erachter te komen hoe ze deze kunnen omzeilen.
"De gratis parafraseerprogramma's die ik heb geprobeerd, hebben Google DeepMind's SynthId overigens snel omzeild," schreef hij.
Een recent onderzoek onder 1.682 volwassenen, gepubliceerd in het tijdschrift Judgment and Decision Making, wees uit dat deelnemers verhalen gegenereerd door ChatGPT beoordeelden als boeiender en van hogere kwaliteit dan door mensen geschreven verhalen. Respondenten gaven echter hogere beoordelingen aan verhalen waarvan ze dachten dat ze door mensen waren geschreven. In twee aanvullende experimenten vonden de onderzoekers geen algemeen bewijs dat deelnemers betrouwbaar konden onderscheiden tussen door mensen geschreven en door AI geschreven verhalen.
Anthropic stelde dat het watermerk de output van Claude niet zichtbaar zal wijzigen en de betekenis of leesbaarheid ervan niet zal beïnvloeden. Het bedrijf gaf toe dat het systeem een signaal biedt in plaats van sluitend bewijs van de herkomst van een stuk inhoud, waardoor het aan bedrijven en uitgevers is om te bepalen hoeveel gewicht ze aan de nieuwe markeringen willen toekennen.