Le discours autour des serveurs d’IA d’Apple s’articule autour de trois points : l’architecture mémoire de la série M, l’efficacité énergétique et la confidentialité. Le point de vue cité met en avant 512 Go dans un unique pool de mémoire à 1,2 To/s, jugé bien adapté aux charges de travail de décodage MoE clairsemé. L’argument affirme également que la conception d’Apple peut convertir chaque watt provisionné en environ 2 à 3 fois plus de mémoire de modèle que la DGX Station de Nvidia, tout en restant refroidie par air, l’alimentation étant décrite comme une contrainte clé. L’architecture de confidentialité d’Apple est également citée comme faisant partie de son attrait.