AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine
AMD e Cerebras Systems hanno unito le forze per sviluppare una soluzione innovativa per l'inferenza AI, combinando le tecnologie Helios e Wafer-Scale Engine.

In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026 attraverso Cerebras Cloud.
- Quali sono i vantaggi della nuova architettura?
- Un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni standalone.
AMD e Cerebras Systems hanno annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale (AI). Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, dando vita a una soluzione disaggregata per l’inferenza AI. La nuova tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, che rappresenta una delle più avanzate implementazioni nel settore.
La struttura proposta sposta le fasi di prefill e di elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero flusso di lavoro. Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Questo modello, con un peso complessivo in INT4 di circa 500 GB, richiederebbe oltre una dozzina di wafer per un’implementazione esclusivamente WSE, mentre un rack Helios può ospitare il modello molte volte, rendendo la soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Il miglioramento delle prestazioni è significativo, soprattutto per modelli più densi e compatti, ma è necessario condurre ulteriori test comparativi, anche rispetto ad altre offerte rackscale di fornitori concorrenti. Non sono stati resi noti i termini finanziari dell’accordo tra AMD e Cerebras, ma il movimento avviene in un contesto di crescente attenzione da parte degli investitori verso il finanziamento circolare nel settore dell’AI.
Inoltre, l’annuncio arriva dopo che Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti nel valore azionario dall’inizio dell’anno.
