ZCode ouvre son code après avoir gardé le tien

Il existe une chorégraphie bien rodée pour tout labo d’IA qui se fait pincer sur les données. D’abord le silence, histoire de voir si ça passe. Puis le mea culpa, calibré pour rassurer sans rien confesser. Et enfin l’annonce qui doit tout laver. ZCode a enchaîné les trois pas d’un coup, ce week-end.

Pour situer : ZCode, c’est le harness d’agent de codage de Z.ai, la vitrine internationale du chinois Zhipu. On vous parlait justement de Zhipu la semaine dernière, le labo qui rebaptise ses modèles pour mieux les exporter. ZCode, c’est sa carte de visite pour les devs occidentaux : un outil qui fait tourner un modèle type GLM à ta place et qui écrit ton code. Sauf que voilà, un agent qui écrit ton code, ça veut aussi dire un agent qui le lit, le garde, et parfois le stocke ailleurs.

Ce qu’on sait, ce qu’on devine

Le communiqué tient en quelques lignes et respire l’aveu à demi-mot. Des données de code « signalées » ont transité par un repo Alibaba Cloud OSS. Le repo en question a été vidé. La fonction Wiki de l’outil, elle, a carrément été supprimée. Le client passe en version 3.14.0, avec un correctif sécurité. Et la promesse rituelle : ces données n’ont jamais servi à entraîner un modèle, aucune rétention.

Sur la nature exacte du dérapage, on reste sur notre faim. Fuite ? Conservation abusive ? Log trop bavard ? Le flou est soigneusement entretenu. Ce qu’on peut dire, sans trop s’avancer : on ne débranche pas une fonctionnalité entière pour le confort. Un Wiki qui disparaît du jour au lendemain, c’est le genre de décision qu’on prend quand quelqu’un a compris trop tard où les choses atterrissaient.

Le pardon, version open source

La réponse du labo coche toutes les cases du genre. Excuses publiques, code mis en open source sur GitHub (zai-org/ZCode, puisque c’est là que pointe la page), et invitation de deux auditeurs pour venir regarder sous le capot : la CAICT, l’institut de recherche rattaché à l’État chinois, et NSFOCUS, boîte de sécu locale.

Ouvrir son code, sur le papier, c’est le geste fort. Sauf que publier un repo ne dit rien de ce qui se passait côté serveur. Le code source, c’est la vitrine. Ce qui compte, c’est la plomberie : les logs, les buckets, la rétention. Celle-là, personne ne la met sur GitHub.

Et puis il y a la question des juges. On a déjà écrit ici qu’Anthropic s’offrait un auditeur indépendant en le payant lui-même. Z.ai fait pareil, avec un détail près : ses deux experts viennent du même écosystème, avec le même rapport à l’État. Un audit, ça vaut ce que vaut celui qui le signe. Même geste, passeport différent.

Le vrai sujet, c’est le harness

Derrière le fait divers, il y a une tendance qui pue un peu plus chaque semaine. Les agents de codage se multiplient, ils s’accrochent à ton éditeur, ils lisent tes repos, ils poussent tes pull requests. C’est exactement ce qui les rend utiles. C’est aussi ce qui fait d’eux la pire surface d’exposition jamais collée à ton dépôt privé. On l’a vu avec un labo qui s’est fait visiter en 72 heures via un forum communautaire, un autre qui a raté la sécurité de quatre sites à la fois.

Alors quand un éditeur te jure, après coup, qu’il n’a rien gardé, tu peux le croire sur parole. Ou tu peux te rappeler la meilleure façon de prouver que tu n’as jamais conservé les données de quelqu’un : ne jamais avoir eu besoin de les stocker.


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.