Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras annunciano una partnership per una soluzione disaggregata che migliora l'inferenza AI, combinando Helios e Wafer-Scale Engine.

In Breve

Qual è la novità principale dell'accordo tra AMD e Cerebras?
AMD e Cerebras hanno lanciato una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
La nuova architettura offre un aumento fino a cinque volte dei TPS/W rispetto a una configurazione WSE standalone.

AMD e Cerebras Systems hanno ufficialmente annunciato una collaborazione tecnica che unisce il rackscale Helios di AMD al Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. Questa innovativa tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno registrato un incremento significativo delle prestazioni, con un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura avanzata sposta le fasi di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte. Questo miglioramento è particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE, suggerendo la necessità di ulteriori test comparativi rispetto ad altre soluzioni rackscale disponibili sul mercato.

Nonostante i dettagli finanziari dell’accordo non siano stati resi noti, questo annuncio arriva in un contesto di crescente attenzione degli investitori sul settore dell’intelligenza artificiale. Recentemente, Nvidia ha siglato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras ha visto oscillazioni significative del titolo da quando è stata quotata a maggio, mentre AMD continua a registrare rialzi notevoli nel valore azionario year-to-date.