Grok 4.7 te vend du low-cost, ton compteur de tokens paie l’addition

Elon a encore fait du Elon. Le 21 septembre, SpaceXAI balançait Grok 4.7 sur le marché, le patron chantant la victoire avant même que quiconque ait eu le temps d’ouvrir la doc. Sauf que les chiffres finissent toujours par arriver, et ils racontent une histoire un peu moins reluisante que le tweet de lancement.

La 4.7 avance, c’est vrai. TechRepublic note de meilleurs résultats sur les benchmarks de code. Ce qui donne : le modèle s’en sort mieux quand tu lui demandes d’écrire du Python ou de débugger ton usine à gaz. C’est pas rien, on est d’accord.

Mais côté performances globales, les résultats indépendants déçoivent, comme le relève Next. Entre les slides du lancement et ce que les gens mesurent vraiment, il y a un fossé. On connaît la chanson par cœur : chaque nouvelle version est vendue comme un saut quantique, et à chaque fois on retombe sur une itération de plus, bien emballée dans un joli marketing.

Le point qui change tout, c’est le prix. SpaceXAI garde une tarification agressive, plus douce que certains gros modèles sortis ces derniers mois. Sur la grille tarifaire, Grok 4.7 est attractif, presque cadeau. Problème, et il est de taille : le modèle bouffe des tokens comme un ado vide le frigo un dimanche soir. TechRepublic le dit noir sur blanc, la consommation élevée peut faire grimper le coût réel des tâches.

Concrètement : un tarif au token bas, c’est joli sur la plaquette. Mais si ton agent consomme trois fois plus de tokens pour pondre le même résultat, t’as rien gagné. T’as même probablement perdu du fric, en plus d’avoir poireauté plus longtemps. Le low-cost version IA, c’est toujours pareil : l’étiquette au rabais, l’addition au final.

La guerre des tarifs fait rage en ce moment, chacun brandit son prix au million de tokens comme argument massue. On vous parlait il y a quelques jours de Kimi K3 et de sa facture allégée, même cinéma. Le souci, c’est que comparer des modèles sur un tarif au token, c’est comparer des bagnoles sur le prix du plein en oubliant de regarder la consommation. Un moteur qui boit dix litres aux cent, tu peux baisser le carburant à dix centimes le litre, tu resteras le dindon de la farce.

Et je te passe le détail qui fâche : plus ton agent turbine, plus il gaspille. Les modèles bavards adorent se répéter, tourner en rond, relire trois fois le même contexte. À la fin, ta tâche « pas chère » aura coûté plus cher qu’un modèle premium qui fait le job du premier coup. C’est pas une hypothèse, c’est de l’arithmétique.

Donc voilà où on en est. Musk baisse le prix de l’entrée pour attirer le chaland, et l’entrée, effectivement, elle est pas chère. Sauf que la sortie, elle, se paie au kilo de tokens. Si tu comptes basculer ta prod sur Grok 4.7 pour économiser, fais tourner les chiffres sur ton propre trafic avant de signer. Le benchmark de code, c’est le menu. La facture finale, c’est l’addition, et elle arrive toujours à table.


Sources :

Categories

Comments are closed

Latest Comments

Aucun commentaire à afficher.