Technology

Anthropic voegt onzichtbare watermerken toe aan Claude-tekst en ondertekende labels aan AI-bestanden

2 views

Anthropic markeert nu de inhoud die zijn Claude-modellen produceren. Sinds 2 augustus verwerkt het bedrijf een onzichtbaar watermerk in gegenereerde tekst en voegt het ondertekende metadata-labels toe aan ondersteunde afbeeldingsbestanden, in een streven naar meer transparantie rond door AI gemaakte inhoud.

Hoe het watermerk werkt

Het tekstwatermerk is ingebed op modelniveau, niet als een verborgen tag of stukje metadata. Anthropic zegt dat het meegaat met gekopieerde tekst en sommige bewerkingen kan overleven, waardoor het moeilijker is om het per ongeluk te verwijderen. Het bedrijf heeft de volledige technische details van het mechanisme niet vrijgegeven en heeft nog geen openbaar detectietool gepubliceerd, hoewel het zegt dat die eraan komt.

"Een watermerk helpt alleen om te testen of Claude de inhoud mogelijk heeft geproduceerd of verwerkt," zei Anthropic. "Het zegt niets over eigendom of auteurschap en verandert niets aan de rechten van een gebruiker."

C2PA-labels voor afbeeldingen en bestanden

Voor bestanden zoals PNG-, JPG- en SVG-afbeeldingen voegt Claude een inhoudscredential toe: een kleine, cryptografisch ondertekende notitie in de metadata van het bestand die zegt dat het bestand met Claude is gemaakt of verwerkt. Het label gebruikt de open standaard C2PA, hetzelfde systeem dat camerafabrikanten en fotobewerkingssoftware gebruiken om vast te leggen waar een afbeelding vandaan komt. Elke C2PA-compatibele tool kan het lezen, en de ondertekende registratie maakt manipulatie detecteerbaar.

Reactie van schrijvers en ontwikkelaars

De uitrol heeft gemengde reacties opgeroepen. Anthropic zegt dat de wijziging voortvloeit uit zijn toezegging aan de gedragscode van de Europese Commissie over transparantie van door AI gegenereerde inhoud onder de EU AI-wet. Sommige schrijvers en ontwikkelaars verwelkomden de herkomstlabels, maar maakten bezwaar tegen het verborgen tekstwatermerk, met het argument dat het geschreven werk verandert zonder duidelijke toestemming van de gebruiker en dat alleen Anthropic, die de geheime sleutels bezit, het voorlopig kan verifiëren. Toezichthouders en factcheckers zien de markeringen ondertussen als een nuttig hulpmiddel om te traceren waar inhoud vandaan komt.

Source: Anthropic