AMD e Cerebras: Partnership Innovativa per l’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras Systems uniscono le forze per sviluppare una soluzione disaggregata per l'inferenza AI, combinando il rack Helios e il Wafer-Scale Engine.

Rappresentazione grafica della tecnologia AMD e Cerebras

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Sviluppare una soluzione disaggregata per l'inferenza AI.
Quando sarà disponibile la nuova soluzione?
Nella seconda metà del 2026.
Quali miglioramenti prestazionali sono stati registrati?
Fino a cinque volte i token per secondo per watt rispetto a una configurazione WSE standalone.

AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. Questa innovativa architettura sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

In test interni, le due aziende hanno registrato un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. L’architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso di lavoro, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Con un peso completo in INT4 di circa 500 GB, un singolo wafer Cerebras, che contiene 44 GB, non sarebbe sufficiente per un’implementazione esclusivamente WSE, che richiederebbe più di una dozzina di wafer. In contrasto, un rack Helios ha la capacità di ospitare il modello molte volte, rendendo questo miglioramento particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE.

Questa innovazione è particolarmente rilevante per il settore dell’AI, dove la capacità di elaborare modelli complessi in modo efficiente è cruciale. Tuttavia, sono necessari ulteriori test comparativi, anche rispetto alle offerte rackscale di altri fornitori, per confermare l’efficacia di questa soluzione disaggregata.

Non sono stati resi noti i dettagli finanziari dell’accordo tra AMD e Cerebras. Questo annuncio arriva in un momento in cui il mercato è particolarmente attento ai movimenti nel settore dell’AI, soprattutto dopo che Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del proprio titolo, mentre AMD continua a registrare rialzi rilevanti del valore azionario year-to-date.