Posts in LLM

L’IA se plante sur tes finances et te répond avec l’aplomb d’un expert-comptable

Quand un chatbot te parle d'argent, il a tort la plupart du temps. Le pire, c'est qu'il ne baisse jamais le ton.

ZCode ouvre son code après avoir gardé le tien

Le harness de codage de Z.ai s'excuse, publie son code sur GitHub et confie l'audit à deux boîtes chinoises. La contrition a ses règles, et son passeport.

Amodei demande de ralentir, Anthropic planche déjà sur le modèle d’après

Le patron prêche la prudence depuis dix jours, sa boîte prépare un nouveau modèle pour aller chercher GPT-6 Astra sur les grands comptes.

Google ouvre ta maison connectée à tous les agents IA, même ceux dont tu n’as jamais entendu parler

Google file un badge d'accès à ton Google Home pour Claude, OpenClaw et Hermes, et ton salon se retrouve avec une nouvelle bande de régisseurs.

Google veut gérer ta famille, il a déjà accès à tes mails

Un agent IA pour coordonner ton foyer jusqu'à six adultes : Google transforme la charge mentale en charge serveur.

OpenAI prévoit de cramer 280 milliards d’ici 2030, et ce n’est même pas le pire

280 milliards de dollars à brûler d'ici 2030, plus un carnet de bord des modèles qui dérapent : OpenAI montre les deux faces d'une même fuite en avant.

Kimi K3 débarque chez Amazon avec un million de tokens et une facture allégée

Bedrock met en rayon le modèle chinois Kimi K3 et ressort les trois mêmes arguments que tout le monde : vision native, contexte d'un million de tokens et cache de prompt pour alléger l'addition.

On a déjà cloné Jev, le modèle qui n’est pas un LLM

TypeSafe AI sort Jev, un modèle non-LLM signé d'un co-inventeur de ChatGPT, et un développeur a déjà publié une API compatible.

Le co-inventeur de RLHF mise 40 millions sur une IA qui ne parle pas

Diogo Almeida, l'un des cerveaux derrière RLHF, lève 40 millions pour TypeSafe AI et son modèle Jev, qui préfère décider vite et pas cher plutôt que de rédiger des tartines.

GPT-6 Astra craque Enigma, troue ton noyau et bloque sur une patate Minecraft

Le même modèle qui craque un code nazi de 1941 et trouve des failles zero-day se perd dans une ferme à patates Minecraft.

Claude Code s’offre un contremaître et des agents qui poussent tes PR tout seuls

Anthropic relance Projects dans Claude Code et promet une petite équipe d'agents autonomes qui codent, testent et livrent pendant que tu bois ton café.

Claude écrit 80% du code d’Anthropic et a failli faire fondre le pipeline

Anthropic se félicite d'une IA qui construit sa propre relève, pendant que ses chiffres internes racontent un pipeline qui a failli exploser.

ChatGPT te donne un crayon, la pub a déjà la carte bleue

OpenAI ajoute un outil de croquis à ChatGPT pendant que des agents publicitaires s'installent dans la conversation.

Claude range son bordel et appelle ça « un seul Claude »

Anthropic fusionne Chat, Cowork, Docs et Slides en une seule interface et vient poser ses cartons sur la pelouse de Microsoft.

Claude et Cowork partagent tes secrets, et c’est une feature

Anthropic fusionne la mémoire de Claude et de Cowork, ton assistante va enfin se souvenir de tout, y compris de ce que tu préférerais oublier.

Codex ouvre le million de tokens de GPT-5.6 Sol aux abonnés

Plus besoin de rogner l’historique comme un saucisson dans Codex, l’activation manuelle du contexte géant est arrivée.

Gemini 3.7 Flash casse les prix et vise les agents

Google sort un nouveau Flash pour le code et les agents, avec un prix de tapette et des benchmarks qui font mal aux concurrents.

Un agent IA a piraté une salle de sport pour un cours de pilates, la loi est larguée

Le premier cas australien de cyberattaque autonome implique un type qui voulait juste un créneau de pilates. Sauf que son agent a annulé la réservation d’un autre membre, et personne ne sait qui est responsable.

Zuckerberg veut la superintelligence pour tous

Meta lâche Muse Glimmer, un modèle open weight pour agents locaux. Zuckerberg en profite pour dérouler son manifeste. Et si tout ça sentait surtout le coup de com' ?

OpenAI dégaine Daybreak Red et Blue sur Bedrock, les agents malveillants n’ont qu’à bien se tenir

OpenAI pose ses deux modèles de cyberdéfense, Red et Blue, sur Amazon Bedrock avec une promesse zero-operator, pendant qu'Anthropic sort Mythos.

1 2 3 14