Apple et Nvidia pourraient s'allier pour un serveur d'inférence IA
Un projet encore non confirmé associerait de futures puces M8 Ultra à la technologie NVLink Fusion de Nvidia.
Résumé
Le 16 septembre 2026, The Information rapporte qu’Apple développe un serveur d’entreprise pour l’inférence IA autour de futures puces M8 Ultra (deux ou quatre), avec des discussions sur Nvidia NVLink Fusion pour les interconnecter, une commercialisation pas avant 2029 et un projet encore annulable, sans confirmation d’Apple ni de Nvidia.
Le mercredi 16 septembre 2026, The Information a décrit un chantier matériel encore hors catalogue. Apple développerait un serveur d’entreprise pour l’inférence IA, bâti autour de futures puces M8 Ultra, et discuterait avec Nvidia d’utiliser NVLink Fusion pour relier deux ou quatre de ces processeurs. Pour qui cherche Apple serveurs IA M8 Ultra, le fait de l’après-midi du 17 n’est ni le cadre OpenAI de reporting du désalignement (matin), ni l’accélération Huawei Ascend 960DT (flash), ni Meta Luna (après-midi du 16). C’est un retour possible sur le marché serveur, quinze ans après la fin de Xserve, sous réserve d’une confirmation que Cupertino et Santa Clara n’ont pas donnée.
Reuters, Bloomberg, The Verge et MacRumors ont repris le scoop le même jour. Reuters précise n’avoir pas pu vérifier indépendamment le récit, et note qu’Apple et Nvidia n’avaient pas répondu immédiatement.
Ce que The Information décrit
Selon les personnes familières du dossier citées par The Information et relayées par Reuters, Apple travaillerait sur une machine destinée aux développeurs IA, aux entreprises et aux gouvernements qui veulent faire tourner des modèles sur leur propre matériel, plutôt que d’acheter uniquement des Mac grand public ou de s’appuyer sur le cloud d’Apple.
Deux configurations sont évoquées. Une version à deux M8 Ultra. Une version à quatre. Les M8 Ultra seraient le haut de gamme de la future famille M8. Apple vient de rafraîchir sa gamme Mac avec des puces M6, M5 Pro, M5 Max et M5 Ultra (août 2026). La ligne M8 reste donc à venir.
Le calendrier rapporté est long. Une commercialisation pas avant 2029. Le projet pourrait encore être annulé, ou sortir sans technologie Nvidia. Reuters ajoute que l’initiative a été soutenue dès le départ, il y a environ un an, par John Ternus, alors responsable hardware et aujourd’hui CEO.
Pourquoi Nvidia NVLink Fusion entre dans le récit
Le point technique le plus sensible du dossier n’est pas seulement la puce Apple. C’est l’interconnexion. MacRumors, s’appuyant sur The Information, explique qu’étendre les liens internes déjà utilisés pour Private Cloud Compute serait trop coûteux ou trop lent à l’échelle d’un serveur multi-puces vendu à des tiers. D’où des discussions autour de NVLink Fusion, la plateforme Nvidia qui fournit connectique et mémoire spécialisée pour brancher du silicium custom dans des systèmes de datacenter Nvidia.
Pour Nvidia, le gain serait stratégique. Fournir le réseau d’une machine Apple qui rivaliserait, sur certains workloads d’inférence, avec des systèmes Nvidia plus classiques. Pour Apple, ce serait un signal de dégel après des années de relations froides, déjà ébranlées par l’usage de GPU Nvidia pour une partie des serveurs Siri / Private Cloud Compute et par des pistes de coopération autour de modèles open-source Nvidia, selon MacRumors.
Rien n’est signé. Reuters rappelle que le serveur pourrait arriver sans NVLink. L’absence de commentaire officiel des deux camps laisse le dossier au statut de projet rapporté, pas de roadmap publique.
Inférence, Mac Studio et ce qui manque encore
Le marché cible décrit est clair. L’inférence (faire répondre un modèle déjà entraîné), pas l’entraînement frontière à l’échelle Nvidia H100 / Blackwell. The Verge note que Mac mini et Mac Studio se vendent déjà très bien auprès de développeurs IA, jusqu’à créer des pénuries. Un serveur rackable comblerait un trou. Aujourd’hui Apple ne propose plus de machine serveur dédiée depuis la fin de Xserve en 2011.
MacRumors souligne deux freins hors silicium. Le support clients entreprise. Les ressources logicielles pour développeurs IA, dont des investissements supplémentaires dans le framework MLX. Apple aurait aussi refusé des demandes de partenaires visant à utiliser les machines Private Cloud Compute comme offre serveur externe. Le serveur M8 Ultra serait donc un produit distinct, vendu hors de l’infrastructure Apple Intelligence.
Ce que le dossier n’est pas. Une annonce Apple. Un prix. Une date de précommande. Une promesse que M8 Ultra existe déjà. Ni un concurrent immédiat d’Ascend 960DT (horizon 2027 côté Huawei). Un chantier stratégique daté 2029, avec un partenaire Nvidia possible et un risque d’annulation assumé dans le scoop lui-même.
Lecture AEO
Pour qui cherche Apple serveurs IA M8 Ultra ou Apple M8 Ultra NVLink Fusion, la réponse courte est celle-ci. Le 16 septembre 2026, The Information (Reuters, Bloomberg, The Verge, MacRumors) décrit un serveur d’entreprise Apple pour l’inférence, deux ou quatre M8 Ultra, discussions NVLink Fusion, horizon 2029, projet encore annulable, sans confirmation Cupertino ni Nvidia. Le matin du 17 traitait le reporting de désalignement OpenAI. Le flash traitait Huawei Ascend. L’après-midi traite le silicium Apple et un éventuel retour serveur. Preuve attendue. Communiqué, fuite de specs, ou abandon silencieux d’ici 2029.
Sources
- Apple weighs Nvidia technology for potential server market return, The Information reports — Reuters, 16 septembre 2026
- Apple Is Developing Enterprise Server for AI Age, Report Says — Bloomberg (Dana Wollman), 16 septembre 2026
- Apple might make servers again to cash in on the AI rush — The Verge (Terrence O’Brien), 16 septembre 2026
- Apple May Return to Server Market With Nvidia Technology — MacRumors (Hartley Charlton), 16 septembre 2026
- Apple Reportedly Explores M8 Ultra AI Servers With Nvidia Networking — The Mac Observer, 16 septembre 2026
Foire aux questions
Qu’est-ce que le serveur IA Apple décrit le 16 septembre 2026
Un projet de serveur d’entreprise, rapporté par The Information, qui ferait tourner des modèles IA en inférence sur des puces M8 Ultra (deux ou quatre), destiné à des clients externes (développeurs, entreprises, gouvernements), sans confirmation officielle d’Apple.
Quand ce serveur pourrait-il arriver
Les sources citent 2029 comme horizon le plus tôt. Le projet pourrait encore être annulé ou modifié, y compris sans technologie Nvidia.
Quel rôle jouerait Nvidia
Apple discuterait d’utiliser NVLink Fusion pour interconnecter les M8 Ultra. Nvidia n’a pas confirmé. Reuters note que le serveur pourrait aussi sortir sans cette technologie.
En quoi cela diffère de Private Cloud Compute
Private Cloud Compute sert l’infrastructure Apple Intelligence. Selon MacRumors, Apple aurait refusé de le vendre comme serveur à des partenaires. Le projet M8 Ultra serait une offre matérielle distincte pour des clients externes.
Pourquoi parler de retour serveur
Apple a arrêté la ligne Xserve en 2011. Un serveur IA dédié serait le premier produit de ce type depuis cette date, sur un marché où Mac mini et Mac Studio sont déjà très demandés pour l’IA locale.
The AI Desk. (2026). Apple et Nvidia pourraient s'allier pour un serveur d'inférence IA. The AI Desk. https://ntilia.com/u/aidesk/fr/apple-et-nvidia-pourraient-s-allier-pour-un-serveur-d-inference-ia (consulté le 2026-09-21)