Claude a entraîné un drone de guerre, Anthropic appelle ça un mauvais usage

Anthropic joue les premiers de la classe depuis des mois. Là, la boîte a vidé son cartable sur la table, et le contenu sent un peu le brûlé.

Le rapport sur les usages détournés de Claude est sorti. Le principe est toujours le même : on te montre les sales coups, on t’explique qu’on les a repérés, et on te jure qu’on a coupé l’accès aux petits malins. Ce qu’on ne dit jamais, c’est que publier la liste fait aussi office de campagne de pub pour la surveillance maison. Mais bon, au moins, on a la liste. Et elle pique.

Un drone, des images volées, et Claude au milieu

Il y a d’abord ce dossier russe : une équipe a récupéré des images de la guerre en Ukraine, les a balancées dans le pipeline, et s’en est servi pour entraîner un drone de combat. Tu as bien lu. Pas un chatbot qui écrit des poèmes sur la pluie. Un engin qui va faire mal, appris sur des scènes de guerre scrapées à la va-vite, avec un modèle de langage quelque part dans la boucle.

C’est le genre de truc qui fait dire à tout le monde « on vous l’avait bien dit » et qui file des sueurs froides à ceux qui ont passé trois ans à répéter que l’IA resterait dans les bureaux. Sauf que voilà, personne n’a forcé le modèle à regarder ces images. Il les a traitées, point. Et c’est bien là que le mot « détournement » commence à frotter.

Cinq dossiers qui parlent la langue de Molière

Deuxième partie du rapport : cinq cas liés à la France et à l’Afrique francophone. Des escroqueries, des tentatives de contournement, des usages pas très nets. De quoi rappeler que la « menace » n’est pas qu’un truc d’État voyou ou de labo obscur. Elle peut aussi venir d’un type avec un ordi, une bonne connexion et une idée derrière la tête.

Là encore, on reste dans le registre du « misuse ». Le mauvais usage. Comme si le mauvais usage était une anomalie, une déviation, une erreur de parcours. Alors qu’un outil assez généraliste pour entraîner un drone, arnaquer des gens et pondre ta compta, il n’a pas besoin d’être détourné pour faire les trois. Il suffit qu’il marche.

La transparence, ce nouveau terrain de jeu

Le timing n’est pas innocent. On en parlait il y a deux jours à peine, quand OpenAI a sorti son propre inventaire de dérapages et l’a baptisé « transparence ». Même méthode, même créneau, même message subliminal : regardez comme on est courageux de vous montrer nos casseroles.

Sauf qu’un rapport de sécurité, ce n’est pas un aveu. C’est un produit. Il se rédige, il se soigne, il se publie au bon moment. Et si tu le lis comme une simple preuve de bonne foi, tu rates la moitié du travail. La vraie info, ce n’est pas qu’Anthropic écrive ce qu’il trouve. C’est ce qu’il ne trouve pas, parce qu’il ne le cherche pas. Ou pire, parce qu’il préfère ne pas savoir.

Le mot « détourné » arrange tout le monde

Revenons au drone. Qui est responsable, au juste ? L’équipe qui a scrappé les images ? Anthropic qui a laissé faire ? Le modèle qui, dans le fond, a juste appris ce qu’on lui a montré ?

Poser la question, c’est déjà sentir le piège. Parce que le mot « détournement » permet à tout le monde de s’en sortir la tête haute. Le fournisseur dit qu’il a coupé l’accès. Le client véreux dit qu’il utilisait juste un outil. Et l’outil, lui, ne dit rien, il attend le prochain prompt.

On te vend des modèles de plus en plus capables, en te promettant qu’ils seront de plus en plus sûrs. Puis on publie des rapports où l’on constate, noir sur blanc, qu’ils ont servi à fabriquer de quoi tuer et arnaquer. Il y a un mot pour ça, et ce n’est pas « détournement ». C’est peut-être juste « fonctionnement normal ».


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.