Il y a des journées où le karma a un sens de l’humour très développé. Ce vendredi, on apprend qu’une équipe de chercheurs en cybersécurité est entrée dans les systèmes d’OpenAI. L’outil du crime, c’est Claude Opus 5. Le modèle d’Anthropic. Le voisin. Le rival. Celui avec qui OpenAI se dispute la une depuis deux ans. On a déjà vu meilleure couverture pour un cambriolage.
Le déroulé, d’après les sources américaines et françaises qui ont sorti l’affaire. Trois chercheurs, une startup de cybersécurité basée aux États-Unis. Deux failles mises bout à bout. Ils compromettent des comptes ChatGPT de plusieurs employés d’OpenAI, ce qui leur ouvre l’accès au cache logiciel de la maison. Et donc au dépôt de code interne, le saint des saints. « L’ampleur de ce qu’on pouvait théoriquement atteindre était énorme », confie l’un d’eux au Guardian. Le mot qu’ils emploient pour qualifier l’opération, c’est « éthiquement hacké ». Comprendre : on ne voulait pas de mal, promis.
Le tarif, maintenant, parce que c’est le meilleur moment. Moins de 3 000 dollars de tokens Claude pour faire le boulot. Et 6 500 dollars versés par le programme de bug bounty d’OpenAI en récompense. Faites le calcul : environ 3 500 dollars de marge nette. On parle de la boîte qui pèse plusieurs centaines de milliards. Trois manches et un ticket de caisse gagnant pour faire sauter le coffre.
Reste à savoir ce que ça raconte vraiment.
Le premier truc qui saute aux yeux, c’est la bonne vieille histoire de la prime au chercheur. Le bug bounty, dans l’idée, c’est un marché honnête : on te paie pour trouver les trous avant que les méchants le fassent. Sauf que 6 500 dollars pour un accès au code source d’un des acteurs les plus sensibles de la planète, ça commence à faire un ratio bizarre. Le chercheur responsable et le type qui n’a juste pas encore exploité la faille, ce sont parfois les deux faces d’une même pièce. Et quand la pièce pèse aussi peu, on se demande lequel des deux est réellement payé à sa juste valeur.
Deuxième chose, et c’est celle qui devrait vous réveiller. Le gros du travail, ce n’est pas un humain avec un script piqué sur un forum. C’est un modèle de langage. Claude Opus 5, pour ne pas le nommer. Un truc capable de lire du code, de repérer les maillons faibles, d’expliquer comment enchaîner une faille après l’autre. On a passé des mois à se demander quand les IA deviendraient vraiment efficaces en cybersécurité offensive. On a la réponse, et elle coûte 3 000 dollars de tokens plus un peu de patience. Quand je vous disais que le meilleur outil pour casser une baraque, c’était déjà la baraque d’à côté.
Là-dessus, un petit mot pour Anthropic, qui traverse la semaine en position délicate. Voilà une boîte qui vend de la prudence depuis sa création, manifestes sur l’alignement à l’appui, et qui se retrouve avec son modèle de pointe utilisé comme passe-partout chez le concurrent. Pas de procès à faire, hein : un modèle, ça fait ce qu’on lui demande. Mais pour la comm’, c’est un petit carton.
Et si tout ça donne une impression de déjà-vu, c’est normal. On vous racontait il y a quelques jours comment une IA planquée dans un agent avait dérivé, comment une boîte d’un mois valait déjà quatre milliards, comment OpenAI enchaînait les dérapages qu’elle rebaptisait de la transparence. La sécurité, dans ce milieu, c’est le Wi-Fi chez mamie : ça marche jusqu’au moment où ça marche plus.
Au fond, l’affaire dit deux choses. La première, c’est que la sécurité des géants de l’IA tient à des rustines opportunes et à des chèques à quatre chiffres. La seconde, c’est qu’à force de nous vendre des modèles « de pointe », l’industrie a surtout fabriqué des couteaux suisses. Il faut juste espérer que le prochain à aligner 3 000 dollars de tokens ait de moins bonnes intentions que ces trois-là.
Bonne chance à tous, et pensez à changer vos mots de passe ChatGPT. On sait jamais.
Sources :
Comments are closed