Depuis le 2 août 2026, les contenus générés par les nouveaux modèles Claude d’Anthropic embarquent un dispositif de marquage destiné à les rendre identifiables. La mesure, documentée en détail vers le 10 et 11 août 2026, découle de l’entrée en vigueur des obligations de transparence prévues par l’EU AI Act, le règlement européen sur l’intelligence artificielle. Concrètement, Anthropic combine deux approches : un filigrane appliqué aux textes produits et le standard C2PA pour les fichiers générés.
Cette mise en conformité relance une question qui travaille depuis longtemps le secteur : peut-on tracer de façon fiable ce qui sort d’une IA générative ? Le marquage de Claude ne relève plus du simple choix technique interne. Il répond désormais à une contrainte réglementaire européenne qui impose aux fournisseurs de systèmes d’IA générative de signaler que leurs sorties sont artificielles.
Deux mécanismes distincts
La réponse d’Anthropic s’appuie sur deux briques complémentaires. D’un côté, un filigrane sur le texte, censé laisser une empreinte détectable dans les productions écrites de Claude. De l’autre, l’adoption du standard C2PA pour les fichiers générés. Ce dernier, porté par la Coalition for Content Provenance and Authenticity, vise à attacher aux fichiers des métadonnées de provenance qui indiquent leur origine et leur historique de création.
L’articulation des deux répond à une réalité technique : marquer une image ou un fichier structuré ne pose pas les mêmes problèmes que marquer du texte brut. Le C2PA s’insère dans les métadonnées d’un fichier, là où un filigrane textuel doit survivre au copier-coller, à la reformulation et aux modifications successives que subit un contenu écrit avant publication.
Le texte, un cas plus fragile
C’est précisément sur le texte que se cristallisent les interrogations. Contrairement à une image dont la provenance C2PA peut être vérifiée tant que le fichier n’est pas altéré, un texte marqué reste exposé à toutes les manipulations qui effacent les signaux : traduction, résumé, réécriture partielle. La robustesse de ces filigranes face aux usages réels demeure un sujet ouvert, régulièrement discuté par les spécialistes de la détection de contenus IA.
Sur X, plusieurs observateurs du domaine ont réagi à cette annonce en s’interrogeant sur la fiabilité réelle du dispositif et sur sa capacité à résister aux contournements les plus simples.
Ces réactions traduisent un scepticisme qui accompagne toute annonce de watermarking depuis plusieurs années. La détection des textes générés par IA reste une discipline instable, où les outils censés repérer une production automatique produisent régulièrement des faux positifs comme des faux négatifs. Le filigrane à la source est présenté comme une piste plus solide, puisqu’il inscrit le signal au moment de la génération plutôt que de tenter de le deviner après coup.
Une échéance réglementaire, pas une révolution technique
Il faut mesurer la portée de l’événement. Ce que rend public Anthropic vers le 10 et 11 août 2026, c’est avant tout une mise en conformité documentée avec un cadre légal désormais applicable. L’EU AI Act structure les obligations des acteurs de l’IA générative en Europe, et le marquage des sorties en fait partie. La date du 2 août 2026 marque le moment où ces exigences deviennent effectives pour les nouveaux modèles Claude.
Aucun nouveau modèle spécifiquement dédié au watermark, ni chiffre de performance publié, ni décision réglementaire additionnelle ne viennent compléter le tableau sur la période. L’enjeu se résume donc à une bascule : un éditeur majeur de modèles de langage inscrit désormais, par obligation, une trace dans ce qu’il produit. Reste à savoir si cette trace tiendra face aux usages qui, eux, ne se plient à aucun règlement.
