Dopo anni di titubanza, sembra proprio che Apple potrebbe tornare a vendere server, ma in salsa molto diversa rispetto al passato. Le indiscrezioni, infatti, non parlano di una nuova versione di Xserve condita con la strategia enterprise dei primi anni Duemila, ma una macchina progettata specificamente (senza grandi sorprese, in realtà) per l'esecuzione dei modelli di intelligenza artificiale.
Secondo quanto riportato da The Information, Apple sta lavorando da circa un anno a un server enterprise basato sulla propria architettura hardware e destinato non soltanto alla propria infrastruttura, ma alla vendita ad aziende, sviluppatori AI e organizzazioni governative. Il sito avvisa che il progetto sarebbe ancora in una fase preliminare e potrebbe cambiare radicalmente o persino essere cancellato e che, in ogni caso, il possibile arrivo sul mercato sarebbe fissato non prima del 2029. Come spesso accade in casi come questo, tanto Apple quanto Nvidia si sono ben guardate dal commentare il progetto.
In ogni caso, forse la parte più sorprendente di tutto il progetto riguarda proprio Nvidia. Apple avrebbe infatti discusso con l'azienda di Jensen Huang la possibilità di sfruttare NVLink Fusion per collegare tra loro i propri processori, entrando in uno schema che il marchio della mela sta cercando di ridurre all’osso negli ultimi decenni: usare tecnologie di altre aziende solo se strettamente necessario e solo per il tempo utile a sviluppare un’alternativa in casa. Sempre secondo voci non conferma, Apple avrebbe comunque già cercato di sviluppare una propria versione della tecnologia di interconnessione, ma performance e (più probabilmente) scala di produzione la renderebbero poco adatta e troppo costosa.
Due o quattro M8 Ultra per il server Apple
Le configurazioni allo studio per i primi modelli di questo progetto ancora senza nome (pubblico) sarebbero almeno due. Il modello di ingresso monterebbe due futuri M8 Ultra, mentre una versione più potente ne integrerebbe quattro. Gli Ultra rappresentano il vertice della famiglia di processori Apple Silicon e oggi sono alla base dei sistemi Mac Studio.
Esattamente come accade oggi, però, l'obiettivo non sarebbe quello di sfidare frontalmente Nvidia nell'addestramento dei grandi modelli, ma di guardare all'inferenza, cioè alla fase nella quale un modello già addestrato viene usato per elaborare richieste e generare risultati e proprio quello che ci si aspetta generare una enorme domanda nei prossimi anni, man mano che le aziende vorranno della potenza in casa per usare l’AI senza mandare i propri dati sui server di qualcun altro. Il tradizionale rapporto di Apple Silicon fra prestazioni ed efficienza energetica potrebbe rappresentare una caratteristica molto gradita per chi deve gestire i data center dato che i costi dell'elettricità e del raffreddamento rappresentano una componente crescente del TCO.
Un’idea che è nata sul mercato
L'idea del possibile ritorno di Apple nel settore B2B enterprise sarebbe nata dalla grande, e in parte inattesa, domanda di Mac mini e Mac Studio da parte degli sviluppatori di intelligenza artificiale. Grandi laboratori AI ne avrebbero acquistati decine di migliaia, mentre alcune aziende starebbero già utilizzando questi sistemi come piccoli nodi di elaborazione per applicazioni AI. Voci di corridoio molto discrete, ma insistenti, parlano in realtà che le fette più grandi di questa corsa al Mac sia giocata da aziende e apparati cinesi che cercano potenza di calcolo al di fuori dei circuiti “tradizionali”, ma ancora non ci sono conferme.
Mac mini e Mac Studio, però, sono computer progettati come sistemi desktop, al massimo aspiranti al mercato professionale. Mancano quindi di molte di quelle caratteristiche hardware, software e di gestione richieste da un'infrastruttura datacenter enterprise. Un server progettato appositamente permetterebbe ad Apple di capitalizzare questo interesse trasformando Apple Silicon da architettura per personal computer a vera piattaforma per il data center, col rischio di generare un’altra ondata di shortage nel settore della tecnologia.
A ben guardare, inoltre, questo non sarebbe davvero il primo passo dell'azienda in questa direzione dopo la dismissione di Xserve. Apple usa già server progettati internamente e basati su processori propri per Private Cloud Compute, l'infrastruttura che esegue nel cloud i carichi di Apple Intelligence troppo complessi per essere elaborati direttamente su iPhone, iPad e Mac. La differenza fondamentale è che queste macchine fanno parte dell'infrastruttura Apple, mentre il nuovo progetto è destinato a creare prodotti per clienti esterni.
Perché Apple ha bisogno di Nvidia?
Costruire un processore molto potente non basta per realizzare un'infrastruttura AI di altissimo livello: bisogna riuscire a far lavorare insieme molti processori gestendo l’enorme traffico di dati che questi mostri tecnologici masticano al secondo. Come abbiamo già accennato, secondo le fonti citate da The Information, le tecnologie di interconnessione sviluppate internamente da Apple per i propri server sarebbero troppo lente e costose per essere utilizzate su larga scala e la soluzione Nvidia sarebbe stata identificata come la migliore alternativa.
La tecnologia presa in considerazione sarebbe NVLink Fusion, con cui Nvidia ha aperto parte del proprio ecosistema di interconnessione anche ai produttori di processori custom. Questo significa che un'azienda può mantenere i propri XPU o CPU e utilizzare l'infrastruttura Nvidia per collegarli all'interno di sistemi AI su scala rack, senza dover ricorrere a GPU di Huang. Apple potrebbe quindi continuare a controllare il processore, che rimarrebbe basato sulla propria architettura, affidandosi a Nvidia per una parte dell'infrastruttura necessaria a far scalare il sistema.