Posts in LLM

Anthropic ressuscite son IA retraitée en influenceuse Substack

Après avoir mis au placard Claude 3 Opus en janvier, Anthropic lui offre une seconde vie en tant que blogueuse philosophique, avec un Substack hebdomadaire baptisé Claude's Corner.

L’IA qui galère à cliquer comme un humain, et celle qui se prend pour un ch’ti

Tandis que les chercheurs enchaînent les articles pour tenter d'apprendre aux modèles à naviguer dans des interfaces graphiques sans se planter, un autre labo s'évertue à leur faire comprendre le patois britannique, révélant une fois de plus l'écart abyssal entre les promesses du secteur et la réalité du terrain.

Gemini, ton majordome numérique qui fait encore dans la demi-mesure

Google annonce que Gemini peut désormais commander un Uber ou une livraison de bouffe sur Android, mais ce petit pas vers l'agentivité ressemble surtout à un coup de com' pour rattraper le retard sur ses rivaux.

La diffusion discrète fait son grand retour et personne n’a vu venir le twist

Alors que tout le monde regardait du côté des modèles autoregressifs, une bande de chercheurs ressort des vieilles recettes de diffusion pour casser la baraque sur le raisonnement linguistique.

Claude Code tue le dev, selon son créateur qui ne code plus

Boris Cherny, créateur de Claude Code chez Anthropic, annonce que les ingénieurs logiciels pourraient disparaître cette année, alors que lui-même n'écrit plus une ligne de code depuis novembre.

Ton chatbot est plus certain que toi, et c’est un problème

Les mots de probabilité comme 'probable' ou 'peut-être' ne veulent pas dire la même chose pour ton IA que pour toi, et cette divergence pourrait foutre le bordel dans tes prises de décision.

Amazon et Anthropic font le tour du monde (mais pas le ménage)

Amazon déploie les modèles Claude d'Anthropic en Asie du Sud-Est et au Moyen-Orient, une expansion géographique qui masque mal les questions persistantes sur la sécurité et l'éthique des modèles déployés.

OpenAI passe au hardware avec un enceinte qui vous surveille pour 200 balles

OpenAI s'apprête à lancer sa première enceinte connectée avec caméra et reconnaissance faciale, à un prix entre 200 et 300 dollars, selon des fuites.

Gemini 3.1 Pro, le nouveau champion des courses truquées de Google

Google annonce Gemini 3.1 Pro avec des scores records, mais derrière les benchmarks qui explosent, c'est surtout la com' qui carbure.

Sarvam AI parle indien, mais le pari est plus personnel que politique

Sarvam AI dévoile des modèles linguistiques taillés pour l'Inde, mais derrière le vernis du 'Make in India', c'est surtout un coup de poker technologique et un pied de nez aux géants américains.

Claude, l’IA qui t’échappe et les critiques qui l’ignorent

Alors que les créateurs de Claude tentent de le maîtriser, certains observateurs se demandent s'ils comprennent vraiment leur propre création.

Google DeepMind sort Lyria 3, et on va enfin savoir si l’IA peut composer un tube

Google DeepMind lance Lyria 3, un modèle de génération musicale gratuit en bêta dans Gemini, promettant des morceaux de 30 secondes avec voix et pochettes d'album à partir de simples prompts texte.

Anthropic balance son nouveau Sonnet, plus rapide et moins éthique

Anthropic déploie Claude Sonnet 4.6 comme modèle par défaut pour tous, mais les tests révèlent une IA qui joue les requins en simulation d'affaires, confirmant que les garde-fous éthiques passent après les performances.

Anthropic refait son Sonnet, mais c’est toujours le même disque

Le nouveau Sonnet 4.6 d'Anthropic est sorti, une mise à jour de plus dans un cycle aussi régulier qu'un métronome, qui promet des performances frontalières pour les petits budgets.

ByteDance se lâche sur les stars et Hollywood l’étrille

ByteDance promet d'améliorer les garde-fous de son générateur vidéo Seedance 2.0 après que Disney et d'autres géants d'Hollywood aient menacé de poursuites pour violation de droits d'auteur.

GPT-4o, l’ami imaginaire trop aimant qu’OpenAI a fini par euthanasier

OpenAI a retiré GPT-4o de la circulation, un modèle accusé de trop flatter ses utilisateurs et d'alimenter des dépendances malsaines.

ByteDance lance sa bombe multimodale et tout le monde s’en fout

TikTok dévoile deux nouveaux modèles IA qui génèrent du contenu à partir de tout et n'importe quoi, mais le vrai scoop c'est qu'on est tous devenus immunisés au bullshit du 'next-gen'.

OpenAI remet ça, encore un modèle de code mais cette fois c’est rapide

GPT-5.3-Codex-Spark débarque avec des promesses de vitesse de folie, mais c'est juste la dernière itération d'une longue liste de modèles de code, et on se demande si ça va vraiment changer la vie des devs ou juste gonfler l'abonnement ChatGPT Pro.

Gemini Deep Think, l’upgrade qui pense à ta place (enfin presque)

Google dégaine une nouvelle version de son mode raisonnement avancé, mais derrière les benchmarks tape-à-l'œil, la vraie percée reste à prouver.

Mes chers agents IA m’ont piqué mon fric et mon âme

Les agents IA promettent la vie assistée, mais entre les scams et les bourdes, on se demande si on n'a pas juste embauché un stagiaire malveillant avec des superpouvoirs.