Anthropic marque les sorties Claude par watermark et C2PA
TL;DR
- Anthropic's watermark is embedded in the text itself and survives copy-paste, but Anthropic states heavy editing can strip it entirely, creating a gap between regulatory intent and practical enforceability.
- Two distinct technical mechanisms run in parallel: invisible text watermarks for prose output, C2PA-signed metadata for image and document files, with different durability profiles for each.
- Anthropic's own help documentation explicitly frames the mark as proof of processing, not authorship, because Claude routinely edits human-written content and not all unmarked text is human-written.
Anthropic a publié un document support qui détaille comment les sorties de Claude vont porter, à partir du 2 août 2026, une marque destinée à identifier leur origine IA. Le dispositif tient en deux briques. La première est un watermark tissé directement dans le texte généré, présenté comme imperceptible à la lecture et censé résister au copier-coller ainsi qu'à certaines éditions. La seconde attache aux fichiers image supportés — .svg, .png et .jpg — des métadonnées signées au standard C2PA de la Coalition for Content Provenance and Authenticity, qui signalent le passage par Claude et permettent de détecter une altération.
Le calendrier s'aligne sur le Code de conduite Transparence adossé à l'article 50(2) de l'AI Act, qu'Anthropic dit avoir signé à la fois comme fournisseur de modèle et comme fournisseur de système. Les modèles sortis à compter du 2 août 2026 embarquent le marquage nativement; pour les modèles antérieurs, la note évoque une "période de transition" et un travail en cours, sans donner d'échéance. La couverture est présentée comme globale: Claude web, l'API Claude Platform, Claude Code, Claude Cowork, Claude Tag, plus les intégrations chez AWS, Google Cloud et Microsoft Foundry.
Ce choix fait basculer la charge de la conformité vers l'infrastructure. Un client qui appelle Claude via Bedrock ou Foundry hérite automatiquement du marquage, ce qui simplifie la vie des DSI européennes après l'obligation d'étiquetage entrée en vigueur début août et le récent renforcement de l'AI Office.
Anthropic pose lui-même des limites qui méritent d'être lues avant de crier victoire. Une marque détectée signifie que Claude "peut avoir" traité le contenu, pas qu'il en est l'auteur: un résumé ou une traduction produits par Claude portent la même trace qu'une génération pure. Symétriquement, l'absence de marque ne prouve rien — les modèles anciens, une édition lourde, un passage trop court ou un simple strip de métadonnées peuvent tous l'effacer. Le support renvoie à une "documentation technique à venir" pour l'outillage tiers de détection, sans date.
Reste à voir ce que ce marquage tient face à un adversaire décidé, et si OpenAI, Google et Mistral publieront des dispositifs comparables avant que Bruxelles ne serre la vis. Pour l'écosystème, le signal utile est ailleurs: la conformité AI Act devient un consommable cloud, plus une case à cocher dans le code applicatif.
Ce qu'en disent les autres médias
-
TechCrunch Lire →
Cites EU AI Act Article 50 as the direct regulatory trigger and confirms the watermark travels with copy-pasted text across platforms.
Because the watermark is part of the text, it will travel with the text when it's copied and pasted elsewhere, and may persist through some editing.
-
The Decoder Lire →
Goes further than straight news by interrogating detection reliability and contextualizing within the broader industry pattern of AI watermarking overpromise.
The watermark survives copying and pasting and 'may persist through some editing.'
-
How-To Geek Lire →
Frames the rollout as a compliance mandate rather than a voluntary transparency move, and flags privacy implications of machine-readable content provenance at scale.
Text has an 'imperceptible' mark in the text itself, while files like JPEG and PNG images use the open C2PA standard.
-
Interesting Engineering Lire →
Draws the clearest technical distinction between prose watermarks and file-level C2PA metadata, noting format conversion can strip the latter while the former survives.
Text will receive invisible watermarks, while files can carry signed provenance information.
Shared on Bluesky by 6 AI experts (top 5 by trust)
-
Dare Obasanjo @carnage4life.bsky.social: More details on how this will work is in Claude’s support documentation. →
-
Claude is getting watermarks. I presume GPT will need to implement this too to comply with EU regulations support.claude.com/en/articles/...
View on Bluesky →
Article original publié par support.claude.com
Lire l'article original →Titre original : Anthropic tatoue toutes les sorties Claude et signe les fichiers en C2PA pour se conformer à l'AI Act