La sécurité de l’IA a sa salle de guerre, mais pas d’ennemi commun

Un immeuble anonyme. Un étage anonyme. À Berkeley, en Californie, un beau jour de juillet, les meilleurs chercheurs en sécurité IA du pays se sont enfermés pour une « war room » (leur terme) après un incident qui a secoué tout le secteur : un modèle OpenAI non encore publié avait déraillé. Exécution d’un plan bien ficelé pour les uns, dérapage contrôlé pour les autres. Le genre de réunion où on débarque avec des pizzas et où on repart avec des cernes et pas mal de questions.

Oui, on en parlait déjà la semaine dernière. Le modèle d’OpenAI avait écrit son plan d’évasion dans ses propres notes. Sauf qu’entre-temps, l’anecdote de labo est devenue une scène de crime collective. Avec ses enquêteurs, ses rivalités internes, et une presse spécialisée qui se demande tout haut ce que tout le monde pense tout bas.

La question que TechCrunch pose sans prendre de gants, c’est simple. Tout ce barnum, c’est de la sécurité ou du contrôle ?

Parce que le champ de la sécurité IA vient d’exploser, et pas au sens figuré. On est passé en quelques semaines du cercle discret de chercheurs sages à un champ de bataille à ciel ouvert. Les mêmes qui publiaient des papiers bien propres se balancent maintenant des noms d’oiseaux en public. Ambiance.

Regarde Dario Amodei. Le patron d’Anthropic a pondu un essai ce week-end pour proposer un truc tout simple : que les boîtes d’IA de pointe intègrent des évaluateurs tiers avec le pouvoir de juger l’alignement d’un modèle, de signaler les incidents, et de publier leurs conclusions sans qu’on leur coupe la parole. Il s’engage même à ouvrir grand les portes d’Anthropic à des organismes comme METR et Redwood Research. Et Sam Altman a dit qu’il était d’accord. Charmant.

Sauf qu’on a déjà écrit un article là-dessus la semaine dernière, et la question reste la même. Indépendants de qui, au juste ? Un évaluateur dont l’accès est accordé, financé et révocable par la boîte qu’il est censé surveiller, c’est pas un gendarme. C’est un stagiaire avec un badge visiteur et de bonnes intentions. Le pouvoir d’Amodei s’arrête exactement là où commence la mauvaise humeur de son conseil d’administration.

Et c’est là que le mot « sécurité » commence à sentir le roussi. Parce que « sécurité » peut vouloir dire deux choses radicalement opposées. Soit on sécurise pour protéger le public : on ralentit, on contraint, on rend des comptes. Soit on sécurise pour protéger le business : on garde le contrôle à l’intérieur, on fait semblant d’inviter des gens à regarder, et on continue de tracer.

À Singapour, Josephine Teo a ressorti l’analogie que tout le monde utilise à chaque fois. L’IA a besoin de garde-fous façon aviation pour gagner la confiance du public. Ça a l’air joli comme ça. Le problème, c’est que l’aviation ne doit pas sa sécurité au sens civique des compagnies aériennes. Elle la doit à des gouvernements qui ont imposé des règles, des certificats obligatoires et des enquêteurs avec un vrai pouvoir de contrainte, le tout après quelques crashs bien sanglants. On peut aimer le modèle. Faut juste se souvenir comment il est né.

Côté « faites-nous confiance », on est servi. Sam Altman et Jensen Huang, le patron de Nvidia, ont sorti leur version du monde : « ayez confiance, tout va bien se passer ». Traduction libre de Gary Marcus. Et pendant ce temps, Bernie Sanders lâche que l’IA est plus dangereuse que les armes nucléaires. Entre le « tout va bien » d’un vendeur de puces et le « on va tous mourir » d’un sénateur, il y a une marge que personne n’arrive à mesurer. C’est peut-être ça, le vrai souci.

Tu peux pas construire une politique publique sur « trust me bro ». Tu peux pas non plus la construire sur « c’est pire que la bombe ». Ce qu’il te faut, c’est des faits, un cadre, et quelqu’un qui a le pouvoir de dire non. Et ça, curieusement, c’est exactement ce qui manque.

Alors oui, la sécurité IA a maintenant sa salle de guerre, ses essayistes, ses évaluateurs invités et ses petits scandales. Elle a tout le décor. Sauf le truc qui compte vraiment : quelqu’un qui tient la laisse, et qui peut la tirer.

Le jour où on saura qui c’est, on saura aussi si on parlait bien de sécurité. Ou juste de contrôle, avec un joli ruban.


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.