Quatre modèles en un après-midi, le terminal de Simon Willison a fait le plein

Simon Willison a encore frappé. Hier après-midi, il a poussé trois releases de son bébé : llm, la ligne de commande qui te laisse causer à peu près n’importe quel modèle sans passer par une interface web, un abonnement ou une case à cocher. Un outil de dev, sans paillettes, sans vidéo de démo. Et hier, ce truc de dev a fait le plein.

Quatre modèles en une journée. GPT-6 Sol, GPT-6 Luna, Claude Opus 5.5, et un certain Jev. Oui, le même Jev dont on vous parlait il y a quelques jours, celui qu’on a déjà cloné. Sauf que cette fois, il débarque dans un outil qui s’appelle LLM. Cherchez pas la logique, y en a pas.

Sol et Luna, la gamme part en orbite

Commençons par le plus attendu. OpenAI a donc deux nouveaux modèles, gpt-6-sol et gpt-6-luna, et Simon Willison les a branchés dans la release 0.36. Après GPT-6 Astra et ses déboires sur une patate Minecraft, la famille s’agrandit. Soleil et Lune. Tu sens la réunion marketing qui a accouché de ça un vendredi soir à 18h.

Le détail marquant est ailleurs. La 0.36 ajoute une option supports_conversation = False pour les modèles qui n’acceptent que des prompts en un seul tour. Pour dire les choses simplement : certains modèles ne savent pas tenir une conversation. Tu leur envoies un message, ils répondent. Tu enchaînes, ils paniquent. L’outil lève une exception, ConversationNotSupported, avant même que tu essaies, et la commande llm chat refuse la session. C’est propre, c’est carré. C’est aussi un aveu : on te vend des assistants « conversationnels » qui, techniquement, ne supportent pas la conversation. Bienvenue en 2026.

Opus 5.5, le demi-point qui va bien

Chez Anthropic, le plugin llm-anthropic passe en 0.29 et ajoute Claude Opus 5.5. Une virgule après Opus 5, quelques semaines plus tard. Le genre de mise à jour qui te fait te demander si tu dois racheter quelque chose, ou juste relancer une commande. Indice : relance la commande.

Et Jev entre par la porte de service

Là, ça devient amusant. Le plugin llm-typesafe débarque en 0.1a0, encore en alpha, et ajoute le support du modèle Jev de TypeSafe AI. Installation, clé API (la liste d’attente bouge vite, paraît-il), et roule. Sauf que Jev, c’est le modèle qui n’est pas un LLM, pour reprendre notre formule. Et il atterrit dans l’outil qui s’appelle littéralement LLM. La cohérence attendra.

Le plus révélateur, c’est l’usage que montre Simon Willison : des questions oui/non. Tu balances un message, tu ajoutes une question de contrôle, et le modèle tranche. Exemple donné, un message de client qui réclame un remboursement, et la question « est-ce que ce message demande explicitement un remboursement ? ». Un classifieur, quoi. Pas un causeur, pas un génie. Un filtre. Et pour ça, il faut un plugin dédié, une clé API, un mot de passe pour la file d’attente et un modèle qui n’est pas un LLM. La boucle est bouclée, ou presque.

Bref, pendant que les gourous refont le monde sur LinkedIn, le monde tourne encore sur un prompt bien senti tapé dans un terminal. Quatre modèles dans le panier, trois releases en une journée, zéro conférence de presse, zéro communiqué. Il reste des gens qui bossent, et ils bossent discrètement. La prochaine release est déjà dans le pipeline, et personne n’a prévu de keynote pour l’annoncer.


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.