T’as déjà commandé un Uber en sachant que le prix allait doubler dans cinq minutes ? Amazon, lui, a décidé de prendre les devants. Alors qu’Anthropic s’apprête à basculer vers une facturation au token à partir de l’année prochaine, les ingénieurs d’Amazon sont déjà en cuisine pour distiller les modèles stars en versions allégées, histoire de ne pas exploser le budget.
Jusque-là, Amazon payait Anthropic à l’heure de calcul — une facture au lance-pierre, pratique pour les utilisations intensives. Mais le nouveau modèle, c’est du paiement à la pièce : chaque token généré coûte. Et quand tu sais que les agents IA d’Amazon tournent à plein régime, la note peut vite faire mal.
Alors que fait un bon ingénieur ? Il prend le modèle original, le passe à la moulinette de la distillation, et en sort une version plus petite, moins gourmande, mais (espère-t-il) presque aussi performante. Selon The Decoder, c’est exactement ce qui se passe dans les labos d’Amazon en ce moment. Une façon de garder la qualité sans braquer la calculette.
Mais le meilleur, c’est la suite : visiblement, Amazon ne met pas tous ses œufs dans le même panier. Des sources évoquent des discussions avec OpenAI pour explorer des alternatives. Après y avoir investi des milliards, voir Amazon regarder ailleurs, c’est un peu comme si ta moitié commandait un catalogue de rencontres pendant que vous préparez le mariage.
Bien sûr, tout cela reste officieux. Mais le signal est clair : la guerre des prix des API IA ne fait que commencer. Les fournisseurs veulent être payés à l’usage, les clients veulent des modèles toujours moins chers. Et Amazon, comme toujours, compte bien gagner sur les deux tableaux : proposer les modèles aux clients, et les utiliser en interne au meilleur coût.
Alors, est-ce que la distillation va suffire à éponger la facture ? Ou faudra-t-il sortir le carnet de chèques pour OpenAI ? Une chose est sûre : la cuisine interne d’Amazon n’a jamais été aussi animée.
Comments are closed