Claude tatoue toutes ses réponses et personne n’avait rien vu

Depuis le 2 août, chaque texte, chaque image sortis de Claude porte une signature invisible. Si tu n’as rien vu changer, c’est normal. C’est le principe, et c’est précisément ce qui rend l’annonce intéressante.

L’info, révélée par AIBase et remontée sur Hacker News, est simple : Anthropic a déployé sans tambour ni trompette un double dispositif de marquage. Dans le texte lui-même, un watermark invisible, résistant aux copier-coller. Par-dessus, des métadonnées de signature numérique, vérifiables par la machine. Le tout à l’échelle globale, donc oui, tout le monde est concerné.

Officiellement, l’objectif est de se mettre en conformité avec l’AI Act européen, cette usine à gaz réglementaire qui veut que les contenus générés par IA soient traçables. Officieusement, c’est aussi un moyen pour Anthropic de prendre date sur un terrain où tout le monde avance en ordre dispersé. Pendant que OpenAI tâtonne, que Google hésite, voilà Anthropic qui pose un geste concret et global. Et ça, c’est toujours plus efficace qu’un communiqué de presse.

Le double étage est malin. Dans le texte, le filigrane, un peu comme ceux qu’on glisse dans les billets. Par-dessus, une couche de métadonnées signées qui permet de vérifier l’origine du contenu à la source. Ça ne rend pas l’IA moins puissante, mais ça rend la traçabilité possible. Enfin, sur le papier. Parce que la vraie question, celle qui va occuper les forums pendant des mois, c’est de savoir si ce marquage résiste aux attaques. Les chercheurs en sécurité vont se faire un plaisir de tester les limites du truc, et on parie que ça ne va pas tarder.

Et puis il y a l’angle économique. Pour les plateformes qui utilisent Claude en masse, les devs qui intègrent l’API dans des outils de génération de contenu, ce watermark invisible peut devenir un casse-tête. Les éditeurs de solutions enterprise vont devoir décider s’ils le mentionnent, s’ils le laissent passer, ou s’ils tentent de le contourner. Autant de questions qui vont agiter les comités techniques.

Au passage, on note qu’Anthropic déploie ça à l’échelle mondiale dès le 2 août, sans s’embarrasser d’une phase de test pour certains pays. C’est le genre de décision qui fait dire qu’Anthropic joue le jeu des régulateurs, quitte à se mettre les développeurs à dos. Mais on serait bien en peine de leur donner tort : quand une IA est capable de générer 700 000 virus en un éclair, on est contents d’avoir au moins un moyen de savoir d’où vient le texte. Reste à voir si les malins réussiront à effacer le tatouage. Là, je dis pas, c’est un autre match.


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.