Apple envisage un retour dans le secteur des serveurs

Apple développerait un serveur d'IA construit autour du même silicium haute performance M-series Ultra qui équipe ses ordinateurs de bureau Mac, une initiative qui replacerait l'entreprise sur le marché des serveurs d'entreprise pour la première fois en une vingtaine d'années. Selon des informations de The Information, la machine devrait arriver sur le marché en 2029, ce qui en ferait le premier serveur Apple commercialisé en près de deux décennies.

Le projet aurait reçu le soutien du nouveau directeur général d'Apple, John Ternus, lorsque les travaux ont débuté il y a environ un an — une période où Ternus dirigeait encore l'organisation d'ingénierie matérielle d'Apple. Ce détail compte, car il suggère que l'effort est né des groupes puces et matériel plutôt que d'une initiative logicielle ou de services. Ternus a officiellement remplacé Tim Cook au poste de PDG le 1er septembre, après les 15 années de Cook à ce poste, de sorte que le projet de serveur pourrait devenir un élément fondateur précoce de son mandat.

Apple n'a pas confirmé ce plan, et les informations indiquent que l'effort pourrait encore être abandonné avant qu'un produit n'atteigne les clients.

Deux configurations basées sur le silicium M8 Ultra

Tel que décrit, le serveur d'entreprise serait commercialisé en deux configurations différentes :

  • Une version à deux puces utilisant deux des futurs processeurs M8 Ultra d'Apple.
  • Une version à quatre puces utilisant quatre des mêmes processeurs M8 Ultra.

Les deux variantes s'appuieraient sur la stratégie établie d'Apple consistant à augmenter les performances via des puces de gamme Ultra, qui fusionnent plusieurs cœurs haut de gamme dans un seul package pour des charges de travail exigeantes telles que la production vidéo, le rendu 3D et, de plus en plus, l'inférence et l'entraînement d'IA en local. Étendre cette architecture à un système d'entreprise monté en rack constituerait un pas important au-delà de tout ce qu'Apple vend actuellement.

Le rapport indique également qu'Apple explore la possibilité de relier ses puces M8 à l'aide de matériel de réseau de centre de données de Nvidia. Plus précisément, la technologie NVLink Fusion de Nvidia a été évoquée comme une possibilité, des sources ayant déclaré à The Information que les deux entreprises ont eu des discussions sur la manière dont Apple pourrait s'appuyer sur la technologie Nvidia pour ses ambitions en matière d'IA.

Ces conversations ne sont pas garanties d'aboutir à quoi que ce soit de concret. The Information a averti que le projet de serveur d'Apple pourrait être purement et simplement annulé, ou pourrait se poursuivre sans aucune technologie Nvidia à l'intérieur.

Pourquoi les développeurs d'IA continuent d'acheter des Mac

Le calendrier du projet de serveur rapporté coïncide avec une augmentation inattendue de la demande pour les ordinateurs de bureau compacts d'Apple. Les systèmes Mac mini et Mac Studio sont devenus des choix populaires parmi les développeurs d'IA et les entreprises cherchant à exécuter des charges de travail d'IA sans construire de clusters de GPU conventionnels.

Selon The Information, des entreprises d'IA, dont OpenAI, ont acheté des dizaines de milliers de Mac mini et Mac Studio pour entraîner des agents d'IA par apprentissage par renforcement par essais et erreurs. Anthropic a également loué des Mac mini auprès d'Amazon Web Services plutôt que d'acheter le matériel directement.

Ce schéma d'adoption est inhabituel pour Apple, dont les ordinateurs ont historiquement été associés au travail créatif et de productivité plutôt qu'aux opérations de centre de données. L'attrait semble reposer sur la combinaison d'une architecture de mémoire unifiée, d'une forte performance par watt et d'un facteur de forme pouvant être empilé en grand nombre sans les exigences d'alimentation et de refroidissement des serveurs d'accélérateurs traditionnels.

Si les développeurs sont déjà à l'aise pour déployer des flottes de Mac pour le travail d'IA, Apple pourrait y voir une ouverture naturelle pour leur vendre un système conçu à cet effet. Cela permettrait à l'entreprise de capturer davantage de valeur dans un marché qu'elle sert actuellement presque par accident.

Un long chemin de retour depuis l'ère Xserve

Le dernier serveur d'entreprise sérieux d'Apple était le Xserve, une gamme montée en rack que l'entreprise a retirée en janvier 2011. Pendant des années ensuite, la recommandation officielle d'Apple pour les organisations ayant besoin de fonctionnalités de serveur était d'utiliser des Mac mini ou Mac Pro exécutant un logiciel serveur — une solution de contournement plutôt qu'une famille de produits dédiée.

Un retour serait donc plus qu'un lancement de produit ; il signalerait une volonté renouvelée de vendre directement dans les centres de données, un marché où Apple a peu de présence actuelle et où les clients attendent de longs cycles de support, des conditions d'approvisionnement d'entreprise et une intégration profonde avec l'infrastructure existante.

Un partenariat avec Nvidia sur la technologie d'interconnexion, si cela se produit, serait un moyen pragmatique de combler l'écart. La fabric réseau de Nvidia est largement utilisée dans les clusters d'IA, et son adoption faciliterait l'intégration d'un serveur Apple dans des environnements déjà conçus autour du matériel Nvidia.

Les enjeux et les questions ouvertes

Plusieurs détails importants restent en suspens. Le prix, les spécifications de puissance, la capacité de mémoire, le support logiciel et la manière dont le système serait géré à grande échelle n'ont pas été rapportés. On ne sait pas non plus si Apple vendrait le serveur directement aux entreprises, le proposerait via des partenaires cloud, ou le positionnerait principalement comme infrastructure interne pour soutenir ses propres services d'IA.

Le paysage concurrentiel est tout aussi incertain. Le marché des serveurs d'IA d'entreprise est dominé par des systèmes construits autour d'accélérateurs Nvidia et, de plus en plus, par du silicium personnalisé de grands fournisseurs de cloud. Apple entrerait en tant que challenger avec une philosophie architecturale différente, qui met l'accent sur l'efficacité et la bande passante mémoire plutôt que sur le débit brut en virgule flottante.

Se pose aussi la question de l'engagement. Apple a déjà annulé ou discrètement abandonné des projets matériels ambitieux, et un objectif pour 2029 laisse amplement le temps aux priorités de changer. Le soutien rapporté de Ternus au lancement du projet est un indicateur du sérieux interne, mais ce n'est pas une garantie d'un produit commercialisé.

Ce que les informations rendent clair, c'est que les puces M-series Ultra d'Apple ont trouvé un public réel, bien qu'imprévu, parmi les chercheurs en IA. Que cette demande de la base se traduise par un serveur d'entreprise formel dépendra de décisions qu'Apple n'a pas encore prises — et de la volonté de l'entreprise de rivaliser sur un marché qu'elle a quitté il y a plus d'une décennie.

Cet article est basé sur un reportage d'Ars Technica. Lire l'article original.

Originally published on arstechnica.com