Apple a fait le grand saut. Deux semaines avant sa keynote de rentrée consacrée aux iPhone, la firme de Cupertino a balancé sur le marché deux nouveaux Mac mini et deux Mac Studio, propulsés par des puces inédites M6 et M5 Ultra. Pas de keynote, pas de « one more thing », juste des fiches techniques qui débarquent et une date de sortie fixée au 22 septembre. Ce lancement précipité a une explication simple : l’IA locale n’attend plus personne.
Le M6 est la première puce d’Apple gravée en 2 nanomètres. Douze cœurs CPU, douze cœurs GPU, et surtout deux Neural Engines de 16 cœurs chacune, une première. De quoi faire tourner des modèles génératifs directement sur la machine, sans tout envoyer dans le cloud. Apple vante la performance pour les grands modèles de langage, avec l’ambition de rivaliser avec des serveurs musclés. Si ça se confirme, c’est un pavé dans la mare des data centers, déjà pas mal secoués par la flambée des puces et de la RAM.
Le M5 Ultra, lui, pousse l’architecture à quatre dies. Là où les précédents Ultra se contentaient de deux briques, Apple empile désormais quatre composants pour créer un monstre de puissance. On parle de performances qui font pâlir les stations de calcul traditionnelles. Mais attention : plus de puissance, ça veut aussi dire plus de mémoire à nourrir. Et sur ce point, les annonces restent évasives. On nous promet de faire tourner des modèles à des centaines de milliards de paramètres, encore faut-il pouvoir les charger en RAM. Personne ne dit clairement quelle sera la capacité maximale de configuration.
Comme le soulignent Numerama et Next, cette annonce surprise n’est pas un détail. Apple envoie un signal fort : l’IA locale n’est plus un gadget pour développeurs, c’est un argument de vente grand public. Les deux machines arrivent le 22 septembre, probablement juste après les iPhone 18. C’est peut-être pas innocent : pendant qu’Apple occupe le terrain des Mac, les concurrents peuvent toujours courir après leurs benchmarks.
Reste une question que personne ne pose assez fort, et à laquelle Apple ne répond pas : combien de tokens par seconde pour un modèle réellement utile ? On nous vante l’efficacité énergétique, la rapidité, mais les benchmarks indépendants se font attendre. Apple a toujours été discret sur les performances en conditions réelles, et cette fois ne fait pas exception. Les utilisateurs pourront bricoler avec les modèles open source, mais sans chiffres fiables, on reste dans le domaine de la promesse.
Apple vise le trône de l’IA desktop. Le cloud ne va pas disparaître, les data centers non plus, mais la bataille locale est lancée. Et pour une fois, on a hâte de voir si les promesses tiennent la route. Rendez-vous le 22 septembre, avec un portefeuille en alerte.
Sources :
Comments are closed