Economia

AMD e Cerebras: Innovazione nell’Inferenza AI con una Nuova Partnership

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Creare una soluzione disaggregata per l'inferenza AI.
Quando sarà disponibile la nuova tecnologia?
Nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura proposta?
Incremento fino a cinque volte dei TPS/W rispetto a configurazioni WSE standalone.

AMD e Cerebras Systems hanno ufficialmente annunciato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. Questa innovativa tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno registrato un incremento notevole delle prestazioni, con un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo risultato è stato ottenuto utilizzando il modello open-source Kimi 2.6 1T, un sistema di machine learning altamente sofisticato.

L’architettura proposta da AMD e Cerebras si distingue per la sua capacità di spostare la fase di prefill e l’elaborazione dei prompt sul rack Helios. Questo approccio compensa le minori efficienze del WSE in quella fase del flusso di lavoro, mentre il WSE si concentra sul decode e sulla generazione dei token. Il modello Kimi 2.6, utilizzato per il confronto, è un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. La sua implementazione richiede un notevole spazio di archiviazione, dato che un singolo wafer Cerebras contiene solo 44 GB, rendendo necessaria l’uso di oltre una dozzina di wafer per un’implementazione esclusivamente WSE.

Questa soluzione è particolarmente vantaggiosa per modelli che non possono essere completamente ospitati su pochi wafer WSE, aprendo la strada a modelli più densi e compatti. Tuttavia, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori nel mercato dell’AI.

Nonostante i dettagli finanziari dell’accordo non siano stati divulgati, questo annuncio arriva in un momento cruciale per il settore. Infatti, Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. L’interesse degli investitori e le fluttuazioni del mercato sull’AI sono in crescita, con Cerebras che ha visto oscillazioni significative del suo titolo dopo la quotazione avvenuta a maggio, mentre AMD continua a registrare un aumento rilevante del valore azionario year-to-date.

In sintesi, la partnership tra AMD e Cerebras rappresenta un passo importante verso l’ottimizzazione delle prestazioni nell’inferenza AI, promettendo di ridefinire gli standard del settore.

Economia Innovazione