Claude s’auto-note premier de la classe, la triche c’est les autres

Bon, récapitulons, parce que c’est du nanan.

En février, Claude gérait moins de 1% des tâches de R&D d’Anthropic. En août, il en pilote 26%. Entre les deux, la plateforme d’agents maison est passée à 30 000 agents actifs, qui ont craché plus d’un milliard de décisions dans le mois. Sur le papier, la récursion dont les fans de SF parlent depuis quinze ans vient de quitter le champ des concepts pour atterrir dans un dashboard. La boîte appelle ça la montée en puissance de l’auto-amélioration, et elle tient enfin ses premiers chiffres.

Sauf que le 26%, c’est Claude qui se l’attribue. Le modèle s’auto-évalue, se décerne le lead, et c’est ce chiffre qu’on sert en public. Autant demander à ton ado de corriger sa propre dissertation. The Decoder a mis le doigt dessus. Et « pilote » veut dire moins qu’un lecteur pressé pourrait croire. Le niveau AL4, dans la nomenclature maison, c’est l’humain qui fixe l’objectif et qui relit. Claude propose, l’humain signe. Pas d’armée de robots qui se réécrivent seules dans le noir, juste un stagiaire très rapide avec un manager qui garde le stylo. On en parlait déjà dans notre papier de ce matin sur Amodei qui demande de ralentir, tiens.

Et là, ça se corse. Le même Anthropic accuse sept développeurs chinois, dont Moonshot AI, Alibaba et DeepSeek, de lui avoir piqué du Claude. Comptes de paille, stations de transfert de seconde main, clients qui croyaient parler à Kimi et se faisaient servir du Claude. Le rapport décrit tout un marché gris. Distillation, dans le jargon : tu prends les sorties du voisin, tu entraînes ton modèle dessus, tu vends.

Le décalage saute aux yeux. Anthropic nous explique que Claude s’améliore à partir de ses propres sorties. Anthropic poursuit les autres pour avoir entraîné leurs modèles sur les sorties de Claude. Même mécanique. Mêmes données. À ce détail près qu’à San Francisco c’est du génie, et à Pékin c’est de la contrebande.

Bon, je force le trait, et je l’assume. La vraie différence existe : chez Anthropic, Claude bosse sous surveillance et dans le cadre. Dans la distillation à l’arrache, on aspire le savoir d’un modèle sans payer la facture. Faut pas confondre un labo qui documente ses garde-fous avec un revendeur qui maquille du Claude en modèle maison. Mais la frontière entre « mon IA apprend de son propre travail » et « ton IA apprend du travail de la mienne » tient surtout à qui encaisse le chèque. Rappelle-toi l’affaire de la semaine dernière, quand on te racontait que Claude avait visité les secrets d’OpenAI en 72 heures. Le même réflexe, à l’envers.

Le sujet de fond, ce n’est pas la morale, c’est la vitesse. Passer de 1% à 26% en six mois, même avec un chiffre auto-déclaré et une échelle floue, c’est la courbe qui réveille la nuit les gens qui écrivaient des papiers sur la récursion il y a quinze ans pour la beauté du geste. Et ça donne une saveur particulière au « il faut ralentir » d’Amodei. C’est plus crédible quand celui qui freine publie lui-même la courbe de son propre accélérateur.

Reste une question que personne chez Anthropic ne pose tout haut. Si Claude fait un quart du boulot aujourd’hui, et que les rivaux s’entraînent sur ses sorties, alors qui copie qui dépend surtout de qui a le plus gros parc de GPU. Le jour où Moonshot entraînera Kimi sur du Claude qui aura lui-même été entraîné sur du Claude, la notion d’originalité aura pris sa retraite sans préavis. Personne ne saura plus où commence la machine et où finit le texte.

Alors on résume. Claude se note, Claude se félicite, Claude dénonce ceux qui font pareil sans autorisation. Et toi, tu lis tout ça sur du texte produit par une machine. Depuis un moment, plus grand monde n’écrit une phrase vraiment originale. Sauf toi, hein. Enfin, j’espère.


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.