NVIDIA et Amazon continuent leur petit manège à deux. Aujourd’hui, c’est Nemotron 3 Ultra qui débarque sur SageMaker JumpStart. Le modèle de raisonnement « frontière » (ils aiment les grands mots) promet une inférence 5 fois plus rapide et un coût réduit de 30% pour les workloads agentic IA.
Concrètement, si on build des agents IA qui tournent sur SageMaker, on va pouvoir sortir des réponses plus vite sans flinguer son budget cloud. 5x plus rapide, c’est pas rien : les agents pourront enchaîner les appels d’outils, les raisonnements multi-étapes, et tout le tremblement sans faire poireauter devant un spinner.
Les 30% de réduc’, c’est l’autre bonne nouvelle. Parce que le coût de l’inférence, c’est le cauchemar de tous ceux qui veulent scale leur agent IA sans vendre un rein. NVIDIA et Amazon semblent avoir compris que pour démocratiser les agents, faut que le prix suive.
Bon, attention à ne pas s’enflammer. C’est une intégration, pas une révolution. Le modèle existait déjà, il est maintenant disponible sur une plateforme spécifique. Mais pour les entreprises déjà chez AWS, c’est une porte d’entrée de plus pour faire tourner du lourd sans douleur.
Le vrai test, ce sera dans les benchmarks réels, pas dans les slides marketing. Mais sur le papier, Nemotron 3 Ultra a de quoi faire réfléchir ceux qui hésitaient entre performance et budget. Et c’est exactement le genre de combo qui fait avancer le schmilblick, tout en maintenant les marges de NVIDIA et Amazon bien au chaud. Pas de jaloux.
Sources :
Comments are closed